AB
AiBoss
ニュース

アリババが次世代エンドツーエンド音声対話モデル「Fun-Audio-Chat」を発表

Alibaba Tongyiは、次世代のエンドツーエンド音声対話モデル「Fun-Audio-Chat」を発表しました。このモデルは、革新的なエンドツーエンドのシーケンス・ツー・シーケンス・アーキテクチャを採用しており、音声入力から直接音声出力を生成することで、従来のASR+LLM+TTSといったマルチモジュール連結処理を不要にし、レイテンシーを大幅に削減します。OpenAudioBenchやMMAUなどの複数の権威あるベンチマークにおいて、同規模のモデルの中でトップの成績を収め、GLM4-VoiceやKimi-Audioといった主流製品を凌駕する総合性能を実現しています。