ニュース
Xiaohongshuのオープンソース音声合成プラットフォームモデル、dots.tts
Xiaohongshu Dotsチームは、上海交通大学のX-LANCE Labと共同で、20億個のパラメータを持つ完全連続潜在空間自己回帰型音声合成(TTS)基盤モデルであるdots.ttsをオープンソース化しました。このモデルは離散的な音響トークンに依存せず、ゼロショット音声クローニングベンチマークであるSeed-TTS-Evalで最先端の性能を達成し、音色の微調整や音声編集にも対応しています。
Xiaohongshu Dotsチームは、上海交通大学のX-LANCE Labと共同で、20億個のパラメータを持つ完全連続潜在空間自己回帰型音声合成(TTS)基盤モデルであるdots.ttsをオープンソース化しました。このモデルは離散的な音響トークンに依存せず、ゼロショット音声クローニングベンチマークであるSeed-TTS-Evalで最先端の性能を達成し、音色の微調整や音声編集にも対応しています。