2026年10月6日 03:26
Reka AI、全モダリティ統合のRho-1発表
Reka AI's omni-model Rho-1 handles text, images, video, and robot control in a single model
3行まとめ
- •Reka AIが190億パラメータのRho-1を発表
- •テキスト・画像・動画・ロボット制御を単一モデルで処理
- •H100 320基で約3か月学習、計算量は少なめ
詳細
背景
Reka AIは、テキスト、画像、動画、ロボット制御の動作を一つのニューラルネットワークで処理・生成するオムニモデル「Rho-1」を発表した。従来は用途ごとに専門システムへタスクを振り分ける構成が一般的だったが、Rho-1は単一モデルでこれらを扱う設計を採用している。
内容
Rho-1のパラメータ数は190億である。学習にはNVIDIAのH100 GPUを320基使い、期間は約3か月だった。Reka AIによると、現在の最上位モデルが必要とする計算量のごく一部で学習できている。すべてのモダリティをトークンとして扱い、一つの共有コンテキストウィンドウの中で処理する点が特徴で、タスクを専門システムへ振り分ける方式は取らない。
今後の影響
テキストやロボット制御を一つのモデルで扱う構成は、ロボット分野を含む多用途のAI開発で、モデルごとの個別運用を減らす選択肢になる。ただし、記事で示された範囲では性能の比較結果や提供形態の詳細は明らかになっていない。
なぜ重要か
テキスト・画像・動画・ロボット制御を単一モデルで扱う設計と、少ない計算量での学習が示された。
元記事を読む — The Decoder