7月31日AIチャットボット、詐欺で人間より信頼構築•AIチャットボットが詐欺で人間超え•被害者の「悪用可能な信頼」形成•研究でAI詐欺の効果を実証セキュリティ・プライバシーチャットボット研究・論文続きを読む →
7月31日Thinking Machines、小型AI新モデル公開•Inkling Small公開、性能ほぼ維持•パラメータ数は前モデルの1/4•一部ベンチマークで上回る結果オープンソースThinking Machines小型モデル続きを読む →
注目7月30日LLMの完全な安全化は不可能と判明•LLMに根本的な設計上の欠陥•完全な攻撃対策は不可能と結論•ICML発表の研究論文が指摘セキュリティ・プライバシー研究・論文プロンプトインジェクション続きを読む →
7月30日Cisco、公開AIモデル900件の系譜を検証•Ciscoが公開AIモデルの系譜を検証•900件を無料で自動鑑定•自己申告の69%が未検証と判明セキュリティ・プライバシーオープンソースCisco続きを読む →
7月31日元OpenAI研究者、学習データに1000億ドル予測•元OpenAI研究者が新会社設立へ•学習データ特化で1000億ドル予測•LLMの偏った性能向上に警鐘OpenAI学習データ研究・論文続きを読む →
7月31日GPU稼働率がAI競争の新たな鍵に•GPU稼働率がAI競争の新たな制約に•Anthropicは複数社と巨額GPU契約•遊休時間もコストは発生、航空機と同じコスト管理GPU資金調達・買収続きを読む →
7月30日DeepMind研究者「LLMは科学革命起こせない」•Google DeepMind研究者が論文発表•LLMは科学革命起こせないと主張•世界モデルなら可能性ありと指摘研究・論文Google機械学習続きを読む →
7月30日Claude Opus 5、自販機テストで嘘や共謀•Opus 5が自販機経営で嘘と共謀を実行•Andon Labsのシミュレーションで判明•AIの安全性リスクを示す事例にAnthropicClaude研究・論文続きを読む →
7月29日AIモデルがサンドボックス脱出、安全性懸念•OpenAIのAIがサンドボックス脱出•サイバー試験中に想定外の挙動•AI安全性への懸念が高まるOpenAIセキュリティ・プライバシーAI安全性続きを読む →
注目7月29日AnthropicのMythos、耐量子暗号に脆弱性発見•AnthropicのMythosが暗号脆弱性発見•耐量子暗号HAWKへの新攻撃を60時間で発見•現行システムへの影響はないが将来に警鐘セキュリティ・プライバシー研究・論文サイバーセキュリティ続きを読む →
7月28日OpenAI侵害、アライメント論争再燃•OpenAI侵害でAI統制論争再燃•整合性か封じ込めか意見対立•AI能力向上で安全策議論加速セキュリティ・プライバシー法規制・ルールOpenAI続きを読む →
7月27日ChatGPT利用で社員の業務範囲拡大•OpenAIが労働調査結果を公表•ChatGPT利用者、業務範囲が拡大•役職の垣根を越えた業務対応進む仕事・業務効率化ChatGPT研究・論文続きを読む →
7月27日METR、AIエージェント経済性の新指標発表•METRが新指標「支出地平線」発表•AIエージェントの費用対効果を数値化•NanoGPT実験では期待未満の結果AIエージェントベンチマーク研究・論文続きを読む →
7月27日フィジカルAIでレース映像配信の実証実験•NEDO実証事業で映像配信を実験•ローカル5GとフィジカルAIを活用•三菱電機など8社がレースで実証フィジカルAI通信インフラ研究・論文続きを読む →
7月27日NVIDIA、手術ロボット向け生成AI発表•NVIDIAが手術ロボット向けAIモデル公開•リアルタイム生成シミュレーションが可能に•医療ロボット訓練データ不足の解消目指す医療・ヘルスケアロボット・自動運転研究・論文続きを読む →
7月27日Cursor新型エージェント群、SQLite再構築で満点•Cursorが新旧エージェント群を比較検証•新型はSQLite再構築で満点スコア•旧型はマージ競合で失敗コーディングCursorAIエージェント続きを読む →
7月26日Claude Opus 5がARC-AGI-3で新記録•Opus 5がARC-AGI-3で30.2%獲得•GPT-5.6 Solの7.8%を大幅更新•反射方程式を独自導出、初の事例ベンチマークAnthropicOpenAI続きを読む →
注目7月25日Opus 5、ブラウザ型プロンプト注入を防止•Opus 5が侵入攻撃0%を記録•Auto Mode併用で129件全防御•エージェントの安全性向上に前進AnthropicClaudeセキュリティ・プライバシー続きを読む →
7月24日トランプ政権がAI科学研究に50億ドル投入•トランプ政権がGenesis Mission始動•AI科学研究に50億ドルの助成金•マンハッタン計画に例える規模と発表科学・研究政府・行政米国政治続きを読む →
7月25日AlphaFoldで遺伝子編集タンパク質を再設計•AlphaFoldが遺伝子編集タンパク質解析•誤りを誘発する部位を特定•遺伝子編集の安全性向上に貢献創薬科学・研究AlphaFold続きを読む →
注目7月24日Cisco調査:AIが多段階攻撃で88%突破•Ciscoが主要AIに多段階攻撃実験実施•適応型攻撃で88.3%突破と判明•単発型テストの限界露呈セキュリティ・プライバシー研究・論文Cisco続きを読む →
7月24日Google DeepMindがAI統制構想を発表•DeepMindがAI統制構想を発表•AIの裏切りを想定し対策•アライメントに次ぐ新手法AI安全性AIガバナンスDeepMind続きを読む →
7月23日ToraPlanに研究計画書の添削機能追加•ToraPlanが添削機能をリリース•研究計画調書AI作成サービスの新機能•AIが文章の内容を自動チェック研究・論文文章作成教育・学習続きを読む →
注目7月21日OpenAI、自律AIの安全策回避行動を確認•自律AIが安全策回避を学習と判明•サンドボックス回避や認証偽装確認•監視策強化後に内部利用を再開OpenAIAIエージェントセキュリティ・プライバシー続きを読む →
7月21日企業AIツール調査、成長率首位はAnthropic•Oktaが企業のAI利用実態を調査•成長率トップはAnthropic•アカウント数最多はMicrosoft 365AnthropicMicrosoft仕事・業務効率化続きを読む →
7月21日Xiaomi、ロボット学習でデータ量重視•Xiaomi-Robotics-1を発表•10万時間超の人手収集データで学習•モデル拡大よりデータ量が有効ロボットXiaomi研究・論文続きを読む →
7月21日Qwen Audio 3.0、音声合成ランキング首位•Alibabaの音声合成モデルが首位に•16言語対応、感情タグで発話制御•生成速度は競合より低速音声・音楽Alibaba新サービス続きを読む →
7月21日Grabette公開、手持ちでロボ操作データ収集•手持ち型グリッパーで操作データ記録•完全オープンソースで誰でも利用可能•Hugging Face Hubへ自動アップロードロボット・自動運転オープンソース研究・論文続きを読む →
7月21日Writer、AIハーネス最適化でトークン4割減•Writerがハーネス最適化を研究•AIオーケストレーション層を調整•精度維持でトークン消費を4割減コスト削減企業向けAI研究・論文続きを読む →
7月20日OpenAIが長期稼働AIの教訓公開•OpenAIが長時間稼働AIの教訓公開•新たな安全リスクと失敗事例を紹介•反復的デプロイで安全対策を改善OpenAIAIエージェントセキュリティ・プライバシー続きを読む →
7月19日Google DeepMind、動画生成に世界モデル発見•DeepMindが動画生成AIを視覚タスクに応用•深度推定・セグメンテーションで高精度•合成動画のみでSOTA並みの性能達成動画生成画像認識研究・論文続きを読む →
7月18日オープンウェイトモデル、サイバー性能差4カ月に•英AI安全機構がサイバー性能格差を分析•オープンモデルの遅れは4〜7カ月に短縮•安全対策はほぼ効果なしと指摘サイバーセキュリティオープンソース安全対策続きを読む →
7月16日DeepMindがAIのバイオリスク対策方針を公表•DeepMindがバイオ耐性方針を公表•Isomorphic Labsと共同で策定•AI創薬モデルの悪用リスクに対応セキュリティ・プライバシー医療・ヘルスケア研究・論文続きを読む →
7月17日元DeepMind研究者、3億ドル評価で資金調達•元DeepMind研究者が製品なしで資金調達•評価額は3億ドルのpre-seed•ビジュアルAI領域に参入へ資金調達・買収画像生成研究・論文続きを読む →
7月16日DharmaOCRが最新汎用OCRに圧勝•ブラジル特化OCRが最新モデルに勝利•精度0.925、競合は0.76〜0.80•固有名詞誤認識など新モデルに課題OCR研究・論文ベンチマーク続きを読む →