AB
AiBoss
ニュース

Cloudflare 发布 Clef-omni 多模态决策模型,并下调 Clef-flash 价格

Cloudflare 在 Clef 与 Clef-flash 之后推出 Clef-omni,支持音频、视频、图像与文本输入,同时下调 Clef-flash 价格并提升 Clef 速度。官方称该系列为开放权重决策模型。

核心事实

Cloudflare 在其官方博客发布文章,宣布推出 Clef-omni,称该模型可同时接受音频、视频、图像与文本输入。文章还提到,Cloudflare 下调了 Clef-flash 的价格,并让 Clef 的运行速度更快。据该文描述,Clef 与 Clef-flash 是 Cloudflare 的开放权重决策模型,上一周刚刚发布。

按博文说法,Clef-omni 支持的音频格式为 wav 或 mp3,视频格式为 mp4 或 webm,可与文本、图像一并输入。官方表示,开发者无需再搭建语音转文字或拆分音视频通道的级联管线,可直接调用单一模型跨模态做决策。

背景与影响

文章称,决策模型自 TypeSafe 的 Jev 问世以来大多以文本为主;此前的 Clef 已支持图像与视频帧数组,而 Clef-omni 进一步把音频与视频文件纳入输入范围。Cloudflare 在文中表示,其 Clef 项目从决定立项到上线不足一周,模型在周末完成训练,随后于周四发布,并称会继续朝更好、更快、更便宜的方向迭代。

关于价格,博文仅称 Clef-flash 现在比 Jev 更便宜,未给出具体定价数字。具体价格、可用地区、账号与语言支持等,请以 Cloudflare 官网当前信息为准。

限制与来源

上述内容来自 Cloudflare 官方博客文章《Introducing Clef-omni with full multimodality, plus a faster Clef and a cheaper Clef-flash》,链接为 https://blog.cloudflare.com/clef-faster-cheaper-multimodal/ 。本文未对模型性能、实测速度、价格数值或可用范围做独立验证,相关说法均以官方原文为准;博文提到的开发者文档入口亦未在素材中给出具体地址。