AB
AiBoss站
快讯

阿里通义推出多模态 MoE 模型 Qwen3.8-Flash

阿里正式推出多模态MoE模型 Qwen3.8-Flash,总参数125B,每token仅激活6B,原生支持26万token上下文并可扩展至100万。模型采用GDN与QSA混合注意力、门控残差、N-gram嵌入及Muon优化器四大升级,训练成本降至前代1/9,编码与办公能力更强。模型对外提供API服务定价输入1元、输出3元每百万token。