AB
AiBoss
ニュース

小红书 FireRed 推出通用音频语言模型 FireRedAudio

小红书FireRed团队推出通用音频语言模型FireRedAudio,基于9B参数Qwen3.5架构,采用解耦连续表征设计。模型同时支持ASR、音频问答、1小时长音频理解、Zero-shot TTS、指令TTS及语音编辑六大任务。模型在MMAU、MMSU、102语种ASR及Instruct TTS等评测中均取得领先成绩,FLEURS-102平均错误率仅14.94%。