2026年9月9日 21:48
Anthropic研究者「絶滅リスク10%超」
Anthropic scientist puts the odds of AI destroying humanity above ten percent this decade
3行まとめ
- •Anthropic研究者、絶滅リスク10%超と発言
- •元OpenAI研究者は退職・両社を非難
- •AI安全性への懸念が社内から浮上
詳細
背景
Anthropicの研究者エヴァン・ハビンガーは、制御不能な超知能AI(ミスアライメントを起こしたAI)が今後10年以内に人類を絶滅させる確率を10%超と述べた。同時に、OpenAIとAnthropicの両社で事前学習(プリトレーニング)研究に携わっていたジェイコブ・コクソンが退職し、両社が人類絶滅のリスクを認識しながら開発を続けていると非難した。
内容
コクソンは声明で、AI開発企業が安全性への懸念を十分に検証せずに高度なAIモデルの開発競争を優先していると指摘した。ハビンガーの発言は、Anthropic社内でもAIの制御不能化や意図しない目標達成(ミスアライメント)のリスクが軽視されていない証左であり、AI業界最大手の一つの内部から具体的な数値を伴う警告が出た点で注目される。
今後の影響
両社は表向きAIの安全性を重視する姿勢を示しているが、内部関係者からの批判や具体的なリスク評価の公表は、AI開発競争の透明性や規制の必要性について議論を再燃させる可能性がある。今後、他の研究者からの同様の証言や、企業側の対応が注目される。
なぜ重要か
Anthropic研究者がAI絶滅リスクを10%超と発言し、業界の安全性議論に一石を投じた。
元記事を読む — The Decoder