AB
AiBoss
News

Architect 推出 Liquid Inference:为每次 LLM 推理请求实时竞价

Architect Financial Technologies 推出 LLM 路由器 Liquid Inference,对每次推理请求运行实时竞价,由服务商出价、买家按最低合格报价结算,最高价格在生成首个 token 前锁定。

Architect Financial Technologies 已推出 Liquid Inference,一款对每一次请求运行实时竞价的 LLM 路由器。据该来源介绍,这是一个 LLM 推理交易市场:服务商就服务特定模型提交报价,每个请求在报价该模型的服务商之间竞拍,符合买家规则的最低报价胜出。对开发者而言,改动仅限于替换 base URL,代码可保持不变。

流程分为四步:客户端发出标准的 OpenAI 或 Anthropic API 调用;买家的约束条件筛选合格报价;报价该模型的服务商参与竞拍;最高价格在生成开始前锁定,计费仅覆盖实际用量。买家可设置单任务成本上限、首 token 时间限制与最低吞吐量,也可要求指定区域、零数据留存以及服务商或模型白名单。据该来源,账户持有人可查看实时订单簿、各服务商与各模型的报价以及已清算交易。该产品出自一家交易公司而非 AI 实验室,Architect 运营 AX 永续合约交易所,并称在 2026 年 5 月收购了一家美国指定合约市场,以挂牌 GPU 算力期货,尚待监管审查。

该来源提到,Liquid Inference 与 OpenAI 及 Anthropic 客户端兼容,并列出了 Claude Code、Codex、OpenCode、Cursor、Pi 和 Cline 等工具;免费邮箱注册,据称前 500 名用户可获得 20 美元免费推理额度,推荐计划为被推荐费用的 20%,二级推荐另加 10%。服务商通过应用入驻,使用 REST 与 WebSocket API 注册模型和报价,付款经由 Stripe。需要说明的是,上述额度、推荐比例、入驻速度与兼容工具清单均来自该来源的转述,尚未获官方独立确认;平台费率、服务商名单与延迟数据目前未公开,具体价格、功能与地区可用性请以官网当前信息为准。