2026年9月23日 21:31
Qwen-Audio-3.1公開、AI音声価格95%減
Alibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent
3行まとめ
- •Alibaba、Qwen-Audio-3.1を発表
- •音声AI価格を最大95%引き下げ
- •ASR・TTSなど5モデルを新規公開
詳細
概要
AlibabaのAIチームQwenは、音声認識(ASR)・音声合成(TTS)・リアルタイム対話に対応する新モデル群「Qwen-Audio-3.1」を発表した。ASR・TTS・リアルタイム音声対話向けに計5つのモデルをラインナップし、音声処理AIの利用価格を最大95%引き下げた。
内容
ASRモデルは多言語・方言認識の精度を高め、フィラー語や言い直しを自動的に除去する機能を備える。上位モデルのASR-Nextはタイムスタンプ付きで複数話者を識別できるほか、感情や周囲の環境音、機械音なども検出可能にした。TTSモデルは多言語での音声合成に対応し、自然な読み上げを実現する。
今後の影響
音声認識・合成AIの利用コストが下がることで、コールセンターの自動応答や議事録作成、多言語対応の音声アシスタントなど、企業による音声AI活用が広がりやすくなる。Alibabaは画像生成のQwen-Imageなど他分野でも低価格モデルを投入しており、音声AI分野でも価格競争が一段と激しくなる。
なぜ重要か
Alibabaが音声認識・合成AIの価格を最大95%引き下げ、企業が音声AI機能を安価に導入しやすくなる。
元記事を読む — The Decoder