AB
AiBoss
ニュース

Xiaohongshu氏が、統一された音声生成・編集モデルであるFireRedTTS3をオープンソース化した。

XiaohongshuのFireRedチームは、音声生成と編集を統合したモデルであるFireRedTTS3をオープンソース化しました。RedAEのセマンティック強化連続表現とLLM-DiTアーキテクチャに基づき、このモデルは24言語と21の中国語方言において、ゼロサンプル音色クローニング、自然言語音声デザイン、および指定領域の精密な音声編集を実現します。このモデルは4つの公開ベンチマークデータセットで最先端の結果を達成しており、オーディオコンテンツ、ゲームのナレーション、ブランドカスタマーサービスなどのシナリオに効率的なソリューションを提供します。