AIニュース3行まとめ
2026年9月23日 21:31

Qwen-Audio-3.1公開、AI音声価格95%減

Alibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent

3行まとめ

  • Alibaba、Qwen-Audio-3.1を発表
  • 音声AI価格を最大95%引き下げ
  • ASR・TTSなど5モデルを新規公開

詳細

概要

AlibabaのAIチームQwenは、音声認識(ASR)・音声合成(TTS)・リアルタイム対話に対応する新モデル群「Qwen-Audio-3.1」を発表した。ASR・TTS・リアルタイム音声対話向けに計5つのモデルをラインナップし、音声処理AIの利用価格を最大95%引き下げた。

内容

ASRモデルは多言語・方言認識の精度を高め、フィラー語や言い直しを自動的に除去する機能を備える。上位モデルのASR-Nextはタイムスタンプ付きで複数話者を識別できるほか、感情や周囲の環境音、機械音なども検出可能にした。TTSモデルは多言語での音声合成に対応し、自然な読み上げを実現する。

今後の影響

音声認識・合成AIの利用コストが下がることで、コールセンターの自動応答や議事録作成、多言語対応の音声アシスタントなど、企業による音声AI活用が広がりやすくなる。Alibabaは画像生成のQwen-Imageなど他分野でも低価格モデルを投入しており、音声AI分野でも価格競争が一段と激しくなる。

なぜ重要か

Alibabaが音声認識・合成AIの価格を最大95%引き下げ、企業が音声AI機能を安価に導入しやすくなる。

元記事を読む — The Decoder

人気記事