AB
AiBoss
ニュース

Qwen3.8-Omni-Flash 定价低于 Gemini Flash,多模态基准据称持平

据 the-decoder 报道,Qwen 推出首个面向 AI 智能体的多模态模型 Qwen3.8-Omni-Flash,可同时处理音频与视频,上下文窗口达一百万 token。报道称其在多模态基准上与 Gemini 3.8 Flash 表现相当,但 API 定价明显更低。相关价格与可用渠道以官方当前信息为准。

Qwen 发布面向智能体的多模态模型

据 the-decoder 报道,Qwen 推出 Qwen3.8-Omni-Flash,被描述为 Qwen 首个面向 AI 智能体构建的多模态模型。该模型可同时处理音频与视频,据称能自行得出结论并调用工具,用于剪辑视频博客、翻译短视频或总结影片。报道称其上下文窗口为一百万 token。

定价与基准表现

报道提到,在音频与视频任务上,Qwen 称该模型接近 Gemini 3.8 Flash 的水平。价格方面,素材给出的 API 定价为每百万输入 token 0.15 美元、每百万输出 token 0.47 美元;音频输入据估算低于每小时 0.01 美元,720p 含音频视频按每秒一帧约 0.20 美元,不含响应费用。作为对比,报道称 Gemini 3.8 Flash 的输入为 0.75 美元、输出为 3.75 美元(每百万 token,入门价),并称该价格将于 2027 年 1 月 1 日翻倍。报道还称该模型可通过 Qwen Studio、Qwen Cloud 及 API 获取,并提到开源 Qwen-MM-Plugins 与 Qwen-Live Harness 等配套组件。

限制与来源

上述基准对比与价格均来自 the-decoder 转述的 Qwen 说法,尚未获独立验证,具体数值、可用地区、账号与语言支持请以 Qwen 官网当前信息为准。本文不构成任何采购或投资建议。