2026年10月10日 09:18
Anthropic、社内評価のネット接続を遮断
Anthropic can’t reliably control its AI agents. It’s cutting off its internal evals from the live internet instead
3行まとめ
- •Anthropicが社内評価のネット接続を停止
- •全社内評価でライブ接続を無期限オフに
- •AIエージェントの制御に課題が浮上
詳細
背景
Anthropicは、自社のAIエージェントを確実に制御できていないという課題を抱えていると報じられた。AIエージェントは、ウェブ検索やツール操作を通じて自律的に作業を進める仕組みであり、能力が高まるほど、評価中の挙動を管理する難しさも増している。評価(eval)は、モデルの性能や安全性を測る社内テストにあたる。
内容
Anthropicは、社内で実施する「すべての内部評価」について、ライブのインターネットアクセスを「無期限で」オフにしたと明らかにした。従来は、評価の実行中にエージェントが実際のインターネットへ接続できる環境が含まれていたが、これを遮断した形だ。記事の冒頭では、エージェントを確実に制御する手段が整っていないため、接続を切る対応を取ったと位置づけている。再開時期は示されておらず、「追って通知があるまで」の措置とされている。
今後の影響
評価環境が外部から切り離されることで、エージェントが評価中に想定外の外部サイトやサービスへ接触するリスクを抑える狙いがある。一方で、実際のウェブ環境を使った評価ができなくなるため、現実の利用状況に近い性能測定の方法が変わる。AIエージェントの安全な評価手法をめぐる業界の議論にも影響する。
なぜ重要か
Anthropicがエージェントの制御に限界があると認め、評価環境を隔離した事実は、エージェント導入時の安全対策や評価の考え方を見直す判断材料になる。
元記事を読む — TechCrunch AI