AB
AiBoss
ニュース

GLM 5.3 FlashX 上线 Vercel AI Gateway

Vercel 更新日志显示,Z.ai 的多模态编程模型 GLM 5.3 FlashX 已上线 AI Gateway,作为高速推理服务选项,官方称推理速度约每秒 200 tokens,适用于编程智能体与交互式应用。

核心事实

据 Vercel 更新日志,GLM 5.3 FlashX 现已在 Vercel AI Gateway 上线。该模型被描述为 Z.ai 多模态编程模型的高速推理服务选项,官方给出的推理速度约为每秒 200 tokens,用于加快流式响应。开发者可通过模型标识 zai/glm-5.3-flashx 在支持的 API 格式与编程智能体中使用,日志同时给出了基于 AI SDK 的 streamText 调用示例。

背景与影响

Vercel 表示,更高的服务速度适合编程智能体、工具调用循环以及用户需要等待生成结果的交互式应用。AI Gateway 定位为统一调用入口,可跟踪用量与成本,并配置重试、故障转移与性能优化;官方称其包含自定义报表、API 密钥预算与路由规则等功能。关于计费,日志称 AI Gateway 按提供商价格呈现、不加价,且不对推理收取平台费用,BYOK 请求亦如此。上述定价与功能表述来自来源页面,具体以官网当前信息为准。

限制与来源

本文信息来自 Vercel 更新日志页面,未包含独立实测数据或第三方评测。每秒 200 tokens 为官方表述,实际速度可能因网络、负载与配置而异。模型可用范围、账号与地区支持、计费细则及智能体配置方式,请以 Vercel 与 Z.ai 官网当前说明为准。