AB
AiBoss
News

Perplexity 公布 API 定价页:按 token 计费,工具调用单独收费

Perplexity 官方文档的定价页面梳理了其 API 的计费方式:Router API 与 Agent API 按各模型公布的 token 费率计费,工具调用与搜索请求另行收费,Sonar 系列还需叠加按搜索上下文规模变化的请求费。

核心事实

据 Perplexity 官方文档的定价页面,其 API 平台采用按用量计费的方式。页面显示,Router API 按各模型公布的费率按 token 计费,不收取单次请求费;缓存读取按模型的缓存读取折扣价计费,推理 token 按输出费率计费。Agent API 提供来自 OpenAI、Anthropic、Google、xAI、Z.AI、Moonshot AI、NVIDIA 等第三方的模型,同样按各模型公布的 token 费率计费。

工具调用与模型 token 费用分开计算。页面列出的工具价格包括:标准 web_search 每次调用 0.0025 美元,Fast Search 模式下每次 0.001 美元,fetch_url 每次 0.0005 美元,people_search 与 finance_search 各为每次 0.005 美元,sandbox 按会话计费,每个容器会话 0.03 美元。Search API 按每 1000 次成功请求计费,标准为 5 美元,Fast Search 为 1 美元。

背景与影响

Sonar 系列的成本结构更为复杂:总成本等于 token 费用加上请求费,请求费随搜索上下文规模(低、中、高)变化,仅适用于 Sonar、Sonar Pro 和 Sonar Reasoning Pro。页面给出的 token 费率中,Sonar 输入与输出均为每百万 token 1 美元,Sonar Pro 为输入 3 美元、输出 15 美元,Sonar Reasoning Pro 为输入 2 美元、输出 8 美元,Sonar Deep Research 为输入 2 美元、输出 8 美元,另有引用 token 每百万 2 美元、搜索查询每千次 5 美元、推理 token 每百万 3 美元。嵌入模型方面,标准嵌入 pplx-embed-v1-0.6b 为每百万 token 0.004 美元,pplx-embed-v1-4b 为 0.03 美元;上下文化嵌入对应为 0.008 美元和 0.05 美元。

页面还说明,Search API 按每次成功的 POST /search 请求计费,而非请求内的每个查询;无效请求、被限流的请求和上游失败不计费,成功但无结果的响应仍会计费。Pro Search 需要开启流式输出,并通过参数启用。

限制与来源

以上信息来自 Perplexity 官方文档定价页面,具体费率、计费单位、可用模型与购买方式可能随时调整,实际以官网当前公布的信息为准。页面提到可通过 AWS Marketplace 购买 API 额度,也可联系销售团队咨询企业定制方案。本文不构成任何采购或投资建议。