2026年8月12日 00:07
NVIDIA、軽量高速モデルNemotron3.5公開
Nvidia's open-weight Nemotron 3.5 Lightning prioritizes speed over maximum intelligence
3行まとめ
- •NVIDIAが軽量AIモデルLightning公開
- •36億パラメータで大型モデルに匹敵
- •処理速度は毎秒670トークンで最速
詳細
概要
NVIDIAはオープンウェイトの新モデル「Nemotron 3.5 Lightning」を公開した。アクティブパラメータ数はわずか36億と小規模ながら、OpenAIの大型モデルgpt-oss-120bと同等の性能をIntelligence Indexで達成した。パラメータ数で4分の1という圧倒的な軽量さにもかかわらず、比較対象モデルと同水準の知能スコアを記録している点が特徴である。
性能
処理速度の面でも際立った結果を示しており、毎秒約670トークンという速度は比較対象の中で最速だった。これは同社が最大限の知能追求よりも、応答速度や効率性を重視する方向性へ舵を切ったことを示している。軽量なモデルでも実用上十分な性能を発揮できることを裏付ける結果と言える。
今後の影響
オープンウェイトモデルの分野では、知能の最大化だけでなく効率や速度を重視する設計方針が新たな選択肢として示された。推論コストや応答速度を重視する企業にとって、Nemotron 3.5 Lightningのような小型高速モデルは検討対象の一つとなる。
なぜ重要か
小型ながらOpenAIの大型モデルと同等の性能を実現し、処理速度は比較対象中で最速だった。効率重視のモデル開発の方向性を示す事例。
元記事を読む — The Decoder