7月27日Cursor新型エージェント群、SQLite再構築で満点•Cursorが新旧エージェント群を比較検証•新型はSQLite再構築で満点スコア•旧型はマージ競合で失敗コーディングCursorAIエージェント続きを読む →
6月18日NRIが語るAIモデルの正しい選び方•NRIがAIモデル選定の考え方を解説•ベンチマークだけでは実力は測れない•業務特性に合わせた独自評価が鍵仕事・業務効率化モデル比較コンサルティング続きを読む →
6月13日Claude Fable 5、価格2倍で性能差は5.7%•Fable 5の性能向上はOpus 4.8比わずか5.7%•価格はOpus 4.8の2倍でコスパが課題•安全フィルターの迂回コストも加わり割高AnthropicClaude料金改定続きを読む →
6月5日エストニア政府がLLMの偽情報耐性を評価•エストニア政府がLLMの偽情報耐性を測定•ロシアのプロパガンダへの抵抗力を比較•モデル間で耐性に差があると判明研究・論文セキュリティ・プライバシーフェイクニュース対策続きを読む →
5月13日日本語でのAI利用コストは英語の約1.5倍と判明•日本語のAI利用コストは英語の約1.5倍•GPT-5.5やClaude Opus 4.7等を実測比較•トークン効率がモデル選びの重要指標に料金改定コスト最適化モデル比較続きを読む →