OpenRouter 上线 GPT-5.6 Luna:主打高并发低延迟场景
聚合平台 OpenRouter 的模型页面显示,OpenAI 的 GPT-5.6 Luna 定位为 GPT-5.6 系列中偏重速度与成本效率的型号,适用于聊天、分类等对延迟敏感的高并发任务。页面同时列出上下文长度、模态与多家托管方信息,相关数据尚未获 OpenAI 官方确认。
OpenRouter 页面收录 GPT-5.6 Luna
模型聚合平台 OpenRouter 的模型页面显示,OpenAI 的 GPT-5.6 Luna 被描述为 GPT-5.6 系列中一款偏重速度与成本效率的模型,适用于聊天、分类以及轻量级智能体工作流等对延迟敏感、请求量较大的任务。页面标注其上下文长度为 1.1M,输入输出模态为文本,并称可接受 PDF、图片与文本等文件输入、返回文本。据该页面,模型由 OpenAI、Azure、Amazon Bedrock 等托管方提供,请求可在其间自动切换。
背景与影响
OpenRouter 的定位是让开发者用兼容 OpenAI 的接口调用多家厂商的模型,因此这类页面通常被视作模型可调用性与托管分布的参考入口。页面还列出了 Artificial Analysis 的多组评测分数,并按推理强度(如 max、xhigh、high、medium、low、非推理)分列,同时给出各托管方的价格、延迟、吞吐与可用性数据。对需要控制单位成本、又要求响应速度的团队而言,这类信息有助于比较不同托管路径。不过,评测口径、路由策略与折扣机制都会影响实际体验,页面本身也提示缓存与折扣可能使实际支付价格低于标价。
限制与来源
需要说明的是,上述内容来自 OpenRouter 的模型页面,属于第三方聚合信息,尚未获 OpenAI 官方确认。页面中的价格、上下文长度、托管方列表、可用性比例与评测分数均为该页面所载,可能随时间调整;不同地区、账号类型与路由模式下的实际可用性、计费方式与功能支持也可能不同。是否支持工具调用、结构化输出、提示缓存等能力,以及具体计费规则,请以 OpenAI 与各托管方的官网当前信息为准。本文不构成任何采购、投资或法律建议。