ニュース
アリババ同義は、大規模なエンドツーエンド音声認識モデルであるFun-ASR1.5を発表した。
Alibabaは、30言語に対応し、自動言語切り替えと複数言語混在音声をサポートするエンドツーエンド音声認識モデル「Fun-ASR 1.5」をリリースしました。このモデルは中国語の主要7方言に対応し、前バージョンと比較して単語誤り率が56.2%削減されています。新たに追加された古典詩認識機能は、97%の精度を実現しています。Fun-ASR 1.5はMoEアーキテクチャを採用し、インテリジェントな句読点予測と、数字や日付などのテキスト正規化をサポートしています。現在、Alibaba CloudのBailianおよびModaコミュニティで利用可能です。