2026年9月29日 23:45
ElevenLabsの新音声モデルv4、表現力向上
ElevenLabs' new v4 speech model makes AI voices more expressive and consistent
3行まとめ
- •ElevenLabsが音声モデルv4を発表
- •笑いや囁きの表現・長時間の一貫性向上
- •Voice Arenaで競合上回る評価獲得
詳細
概要
ElevenLabsは新しい音声合成モデル「Eleven v4」を発表した。笑い声や囁き声といった感情表現の指示をこれまでより正確に反映できるようになったほか、オーディオブックのような長時間コンテンツでも声質の一貫性を保てるようになった点が特徴で、ナレーションやポッドキャストなど長尺の音声制作での実用性が高まっている。
Turbo版の低遅延設計
同時に発表されたTurbo版は、わずか150ミリ秒で発話を開始できる低遅延設計を採用しており、リアルタイムで応答する音声エージェント向けに最適化されている。カスタマーサポートや対話型アシスタントなど、即応性が求められる用途への展開を想定した設計だ。
評価と競合との比較
音声AIの性能を比較するArtificial Analysisの「Voice Arena」リーダーボードでは、v4はCartesiaやGoogleのGeminiを上回るランキングを獲得した。音声合成分野では表現力・一貫性・応答速度のバランスが競争軸となっており、ElevenLabsは主要プレイヤーとの差別化を進めている。
なぜ重要か
ElevenLabsの新モデルは表現力・一貫性・応答速度で競合を上回り、音声AI市場の競争が激化している
元記事を読む — The Decoder