ニュース
Qwen3-TTSのフル機能版がオープンソースとしてリリースされました!
Tongyi Qianwenチームは、1.7Bおよび0.6Bパラメータスケールを含むQwen3-TTSシリーズの音声生成モデルを正式にオープンソース化しました。このモデルは、音色の複製、音色の作成、擬人化された音声生成を完全にサポートしています。革新的な12Hzマルチコードブック音声エンコーダとデュアルトラックモデリングアーキテクチャを採用することで、効率的な音声圧縮と高忠実度再生を実現し、最初のパケットの音声遅延はわずか97ミリ秒です。このモデルは、中国語、英語、日本語、韓国語を含む10の主要言語と方言をカバーし、自然言語コマンドによる音色、感情、リズムの精密な制御をサポートしています。