Together AI 推出 Together Link:在既有编码代理中调用开源模型
Together AI 发布 Together Link,可将团队已在使用的编码代理接入其开源模型,官方称可节省超过 50% 支出,支持 Claude Code、Codex、OpenCode 等,通过一条命令安装。
核心事实
Together AI 在其官方博客发布 Together Link,定位是让开发者继续使用现有的编码代理(harness),同时把请求接到 Together AI 上的开源模型。据该博客介绍,Together Link 支持 Claude Code、Claude Desktop、Codex(ChatGPT 应用与 CLI)、OpenCode 和 Pi,安装方式为一条 curl 命令,配置与登录方式保持不变,官方称可在数分钟内完成切换,也可用一条命令切回原有的闭源模型。
博客称,Together Link 提供“Auto”模式,由 Together AI Router 根据会话的首个任务选择模型:简单修复走低成本快速模型,困难问题走前沿能力模型。若用户自带 Anthropic 密钥,则在 Opus 5.5 与 GLM 5.3 之间路由;不带则在 GLM 5.3 与 GLM 5.3 Flash 之间路由。路由每个会话只发生一次,以便提示缓存继续生效。计费沿用现有的 Together API 密钥,按无服务器按量付费或额度包结算。
背景与影响
博客提到,编码代理在工程团队中已相当普遍,但许多任务都跑在同一款高价模型上,规模扩大后成本迅速上升,工程组织每月在闭源模型上的支出从数万美元到数百万美元不等。该文认为开源模型与闭源头部模型的差距已明显收窄,Kimi K3、GLM 5.3 等可承担不少高难度编码任务,GLM 5.3 Flash、DeepSeek V4.1 Flash 等较小模型则处理日常任务。Together AI 还称,其无服务器推理承载了 OpenRouter 上 DeepSeek V4.1 Flash(40.8%)、GLM 5.3 Flash(28.2%)和 Kimi K3(23.1%)的最大份额,该数据标注截至 2026 年 9 月 30 日。
限制与来源
上述节省比例、模型路由规则、支持工具清单与份额数据均来自 Together AI 官方博客,尚未见独立第三方验证;具体可用模型、支持地区、价格与账号要求可能随时调整,请以 Together AI 官网当前信息为准。本文不构成任何采购或投资建议。