Jan Leike
Jan Leikeヤン・ライケ
アラインメント科学チーム 統括

AIアラインメント研究を代表する研究者。オーストラリア国立大学で強化学習理論の博士号を取得後、DeepMindで人間のフィードバックによる強化学習(RLHF)を試作した。2021年にOpenAIへ移り、イリヤ・サツケヴァーと共にSuperalignment(超整合)チームを共同統括し、InstructGPTやChatGPT、GPT-4のアラインメントに携わった。2024年5月にAnthropicへ移籍し、現在はアラインメント科学チームを率い、スケーラブルな監督や弱から強への一般化、アラインメント研究の自動化に取り組む。

出演している動画

OpenAI's huge push to make superintelligence safe | Jan Leike
80,000 Hours · 2023年

OpenAIのSuperalignmentプロジェクトについて語る回。4年でスーパーインテリジェンスのアラインメントを解くという目標、計算資源20%の投入、スケーラブルな監督や「自動アラインメント研究者」を構築する計画を詳細に解説する。

24 - Superalignment with Jan Leike
AXRP · 2023年

AXRPのDaniel Filanとの対談。OpenAIのSuperalignmentチーム発足の背景とロードマップ、直面する技術的課題、そしてアラインメント研究そのものをどう自動化していくかを掘り下げて議論する。

Jan Leike – Supervising AI on hard tasks
FAR·AI · 2024年

ウィーンのAlignment Workshopでの講演。超整合の問題を「難しいタスク上でAIを監督する」という枠組みで捉え直し、人間の能力を超えるAIの出力をどう評価・監督するかという課題と手法を論じる。

How difficult is AI alignment? | Anthropic Research Salon
Anthropic · 2025年

Alex Tamkin、Amanda Askell、Josh Batsonと登壇したパネル討論。AIアラインメントの難しさ、スケーラブルな監督や解釈可能性の限界、行動が複雑化した際の評価の困難さについて語り合う。