2026年8月8日 02:35
AnthropicがFable 5の誤検知を85%削減
Anthropic loosens Fable 5's biology restrictions but keeps the guardrails on for virology and toxicology
3行まとめ
- •Fable 5の生物学誤検知が85%減少
- •ウイルス学と毒性学は制限を維持
- •劣るモデルへの誤振り分けを改善
詳細
背景
Anthropicは大規模言語モデルClaudeの最新版Fable 5において、生物学関連の質問に対する安全フィルターの誤検知が多く、ほぼすべての生物学関連クエリが自動的にブロックされ、性能で劣るOpus 5にリダイレクトされる問題を抱えていた。悪用防止のための安全対策が、正当な学術・医療目的の利用まで妨げていたことが課題となっていた。
内容
今回Anthropicは、この生物学分野の安全フィルターにおける誤検知率を約85%削減したと発表した。これにより、通常の生物学関連の質問はFable 5が直接処理できるようになり、性能が劣るモデルへ不必要に振り分けられる頻度が大幅に減少する。一方で、ウイルス学や毒性学など、生物兵器転用のリスクが高いとされるデュアルユース性の高い領域については、引き続き厳格な安全ガードレールが維持される。
今後の影響
安全性と実用性のバランスを取る取り組みとして、AIモデルの安全フィルター設計における重要な事例となった。過剰なブロックによるユーザー体験の低下を防ぎつつ、真にリスクの高い領域への警戒は維持するアプローチであり、他のAI企業のコンテンツモデレーション設計における参考例となる。
なぜ重要か
生物学関連の誤ブロックが減り、Fable 5が正当な学術・医療利用でも使いやすくなった。
元記事を読む — The Decoder