2026年8月6日 22:33
Qwen3.8 Max、Opus接近もKimi K3優位保つ
Qwen3.8 Max catches Claude Opus 4.8 but Kimi K3 still scores higher for 25 percent less
3行まとめ
- •Qwen3.8 Maxが指数で56点獲得
- •前版比10点上昇、Opus 4.8に接近
- •Kimi K3は25%安く高スコア
詳細
概要
Alibabaの新モデル「Qwen3.8 Max」が、AI性能評価機関Artificial Analysisの「Intelligence Index」で56点を獲得した。これは前版「Qwen3.7 Max」の46点から10点の上昇であり、Anthropicの「Claude Opus 4.8」に迫るスコアとなった。同指数は複数の主要ベンチマークを統合してモデルの総合的な知能を数値化する指標で、モデル選定の参考として業界で広く参照されている。
比較
もっとも、同指数で最上位に位置するのは中国Moonshot AIの「Kimi K3」で、Qwen3.8 Maxを依然として上回るスコアを記録した。さらにKimi K3はAPI利用コストがQwen3.8 Maxよりおよそ25%安く、性能とコストの両面で優位に立つ結果となっている。中国発の複数モデルが上位を競い合う構図が改めて鮮明になった。
今後の影響
Qwen3.8 MaxのスコアはClaude Opus 4.8に迫るとはいえ、依然としてわずかな差が残る。Alibabaが追加チューニングや後継モデルでどこまで差を詰めてくるかが今後の焦点となる。ビジネス利用者にとっては、単純な性能スコアだけでなくコスト効率まで含めた総合評価が、モデル選定の判断材料として一層重要になっている。
なぜ重要か
Qwen3.8 MaxがClaude Opus 4.8に接近したが、Kimi K3が性能・コスト両面で依然優位に立つ。
元記事を読む — The Decoder