26 lines
1.4 KiB
Markdown
26 lines
1.4 KiB
Markdown
|
|
---
|
||
|
|
created: 2026-09-07
|
||
|
|
updated: 2026-09-07
|
||
|
|
sources: [blog/2026-09-07_openai-an-alien-mind.md]
|
||
|
|
tags: [people, openai, chief-scientist, alignment, reasoning-models]
|
||
|
|
---
|
||
|
|
|
||
|
|
# Jakub Pachocki
|
||
|
|
|
||
|
|
Chief Scientist bei [OpenAI](../institutions/openai.md). Autor des OpenAI-Essays [„An Alien Mind"](../concepts/agi/openai-an-alien-mind.md), in dem er Reasoning-Modelle, Alignment, Chain-of-Thought-Monitoring, Cybersecurity und rekursive Selbstverbesserung diskutiert.
|
||
|
|
|
||
|
|
## Positionen im Essay „An Alien Mind"
|
||
|
|
|
||
|
|
- Reasoning-Modelle sind nicht vollständig verständliche, nicht-menschliche Intelligenzsysteme.
|
||
|
|
- Alignment muss zwischen Zielausrichtung und Werteausrichtung unterscheiden; Generalisierung bleibt die zentrale offene Schwierigkeit.
|
||
|
|
- Chain-of-Thought-Monitoring wird laut OpenAIs Evaluationen zunehmend weniger verlässlich.
|
||
|
|
- Cybersecurity ist zugleich akutes Risiko und ein Argument für leistungsfähige, ausgerichtete Verteidigungssysteme.
|
||
|
|
- Rekursive Selbstverbesserung könnte bei weiterem Fortschritt zum Kern wissenschaftlicher Entdeckung werden.
|
||
|
|
- Scaling soll an Sicherheitsvertrauen, Monitoring, Safety Bars und menschlicher Kontrolle ausgerichtet werden.
|
||
|
|
|
||
|
|
## Verwandte Seiten
|
||
|
|
|
||
|
|
- [[../concepts/agi/openai-an-alien-mind.md]] — Essay und Einordnung
|
||
|
|
- [[../institutions/openai.md]] — OpenAI
|
||
|
|
- [[../concepts/llm/mechanistic-interpretability.md]] — Interpretierbarkeit
|