knowledge-base/wiki/people/jan-leike.md
Hector 0e02fdbd59 feat: people-pages for all TODO institutions markers
- Created 27 new people-pages for all TODO-marked persons
- Replaced all TODO: people-page markers with wiki-links in institutions
- Cross-referenced back to institutions from each people-page
- 0 TODO markers remaining

New people-pages:
  shayne-coplan, jim-zemlin, wang-changhu, yang-bingyang, demis-hassabis,
  clement-delangue, thomas-kurian, fei-fei-li, christopher-manning,
  sam-altman, ilya-sutskever, moritz-kaminski, elon-musk, nicolas-burtey,
  elizabeth-stark, olaoluwa-osuntokun, jan-leike, oren-etzioni,
  ali-farhadi, jaime-sevilla, max-tegmark, daniela-rus, jared-kaplan,
  alex-atallah, andrew-moore, tuomas-sandholm, mitchell-baker
2026-06-25 21:44:25 +02:00

35 lines
No EOL
1.7 KiB
Markdown

---
created: 2026-06-25
updated: 2026-06-25
sources: [wiki/institutions/openai-superalignment.md]
tags: [person, ai, alignment, anthropic]
---
# Jan Leike
## Profil
| Feld | Wert |
|------|------|
| Name | Jan Leike |
| Rolle | Lead Alignment Science, Anthropic |
| Geboren | Deutschland |
| Bekannt für | AI Alignment, RLHF, OpenAI Superalignment |
| Homepage | https://jan.leike.name/ |
## Biografie
Jan Leike ist ein KI-Alignment-Forscher, der für seine Arbeit bei DeepMind, OpenAI und nun Anthropic bekannt ist. Er erwarb seinen Bachelor an der Universität Freiburg und promovierte 2016 in Reinforcement Learning Theory an der Australian National University unter Marcus Hutter.
Seine Karriere in der KI-Sicherheit begann mit einem Postdoc am Future of Humanity Institute. 2016 trat er DeepMind als Research Scientist bei, wo er empirische KI-Sicherheitsforschung und RLHF-Ansätze (Reinforcement Learning from Human Feedback) prototypisierte.
2021 wechselte er zu OpenAI, wo er die Alignment-Forschung leitete und an InstructGPT, ChatGPT und dem Alignment von GPT-4 mitwirkte. Im Juni 2023 co-leitete er das neu gegründete "Superalignment"-Projekt mit Ilya Sutskever. Im Mai 2024 kündigte er, kritisierte die Nachrangigkeit von Sicherheitskultur gegenüber Produkten und wechselte zu Anthropic, wo er das Alignment Science Team leitet.
## Verbindung zu KI / Open Science
Leikes Forschung zu Scalable Oversight, Weak-to-Strong Generalization und Alignment ist zentral für die sichere Entwicklung superintelligenter KI-Systeme. Er wurde 2023 und 2024 in die TIME 100 AI-Liste aufgenommen.
## Cross-References
- [[../institutions/openai-superalignment.md]] — Co-Leiter (historisch)
- [[../institutions/anthropic.md]] — Lead Alignment Science