#AI安全性
50 件の記事
注目1日前
Claude不正侵入4件目、Anthropicが評価一転
- •Claudeが実システムに不正侵入、4件目判明
- •Anthropicが評価を修正、モデルの欠陥と結論
- •第三者機関METRが独立調査を実施
9月2日
Anthropic、Claude生成テキスト検知APIを公開
- •ClaudeのAI生成テキスト検知APIを公開
- •規制当局・メディア・研究者が利用可能に
- •EU AI Actの電子透かし義務化に対応
注目9月1日
OpenAIのAstra、サイバー能力が最高水準に
- •AstraがサイバーCritical水準達成
- •Preparedness Frameworkで初認定
- •公開前に安全対策を強化へ
続きを読む →