ニュース2026年9月10日腾讯混元等团队开源统一音频模型AuK上海交大、腾讯混元与上海创智学院等团队开源1.5B参数统一音频模型AuK,可通过自然语言完成语音生成、转换和编辑等任务。上海交通大学、腾讯混元和上海创智学院等团队开源统一音频模型AuK。该模型约15亿参数,以自然语言指令统一处理语音生成、声音转换、音频编辑等五类任务。项目还提供AuK-Flash四步生成版本;论文在匹配条件下报告约4.5倍墙钟加速。模型权重、代码和演示已公开,但论文指标仍需结合具体硬件与任务设置理解。参考:AuK论文、项目主页戻る