全部指南
AI

按实际用量比较 AI 模型价格

输入单价更低,总账单却可能更高。两个算例帮你看清区别。

一个模型每百万输入 token 收费 0.20 美元,另一个收费 0.40 美元。第一个看起来更便宜——直到你让两者都写一个长答案。

要比较的是整个请求的费用:发送多少文本、生成多长的回答、执行多少次。然后检查提供该价格的供应商是否支持你需要的功能。

从一个真实任务开始

选择你实际会运行的任务:总结文档、重写帖子或回答支持问题。输入不只有最后一个问题,还包括指令、对话历史和附加文本。Token 是模型处理文本的单位;不同语言和模型的 token 数不能按固定字数换算。

打开 AI 模型目录,选择一个模型,然后打开 成本估算。从任务预设开始,或输入你自己的输入 token、输出 token 和请求次数。预设是可编辑的示例,不是对你文档的测量。

如果你已有 API 使用日志,请使用其中的 token 计数。没有日志时,可以先估算,再用小规模测试的实际用量修正。上下文限制告诉你能容纳多少,而不是每个请求会花费多少。

为什么输入便宜,总价反而更高

以下是两个虚构报价,价格单位为美元/百万 token。它们用于说明计算;不是指定模型的当前价格。

报价 输入价格 输出价格
A $0.20 $1.00
B $0.40 $0.40

对于 10,000 个请求,每个请求 8,000 输入 token 和 500 输出 token,A 花费 $21,而 B 花费 $34。

将任务改为每个请求 1,000 输入 token 和 4,000 输出 token,保持 10,000 个请求。A 现在花费 $42,而 B 花费 $20。更长的答案逆转了排名。

total = requests × ((input tokens × input price) + (output tokens × output price)) / 1,000,000

我们在 2026 年 10 月 10 日使用目录中相同的 token 成本函数检查了这两个示例。下载输入和结果。这项检查只验证计算结果,不代表模型质量测试或真实账单。

这个简单公式假设普通文本定价,不计折扣或阶梯价格。缓存费率和长上下文阶梯价可能会改变结果。工具调用、图像、音频、单次请求附加费和税费可能会在文本估算之外增加费用。对于实际运行,将估算与供应商的使用记录进行比较;OpenRouter 文档列出了返回的用量字段。

比较同一供应商的报价

开发模型的公司和托管其 API 的服务是不同的选择。在目录中,使用 模型开发商 筛选模型系列,使用 API 服务商 选择在哪里使用它。两者都允许多选。官方 API 标签标识开发者的直接 API。

在选择之前,打开模型的供应商列表。一起检查其价格、上下文和输出限制。不能把一家服务商的低价和另一家的大上下文窗口拼成一个选项。

从你计划调用的供应商复制模型 ID。相似的模型名称不保证相同的 API 标识符。使用聚合器时,还要检查路由:OpenRouter 可以将同一模型路由到不同的端点,所选路由会影响可用功能和价格。

用筛选条件缩小范围

先列出必须满足的条件:足够的上下文以容纳输入和答案,如果需要则支持图像,以及你的应用程序所需的工具调用或结构化输出。然后缩小价格范围并比较几个候选。

速度有两个部分。首 token 时间描述答案开始前的等待。每秒输出 token 描述它继续的速度。缺失的测量意味着未知,而不是慢;这些观测值也不能保证你的请求会达到同样速度。

基准分数可以帮助你选择要测试的内容。它们不能告诉你模型是否会遵循你的特定指令。对你的候选列表运行同一组有代表性的提示,并检查答案、失败和实际 token 使用情况。

目录大约每六小时刷新一次。查看数据来源的更新时间,尤其是当价格或速度看起来异常好时。筛选和排序会保存在网址里,复制地址就能分享当前的筛选结果。

在应用或 AI 助手里复用比较

目录 API 支持条件筛选、供应商比较和 token 成本估算。查询目录不消耗 CozyToolkit 积分,无需 API 密钥,但有请求频率限制。它们不会为你运行模型。

模型研究技能 可以让 AI 助手完成查询。告诉它你的实际用量,而不是要求笼统的“最好模型”:为 10,000 个文档摘要请求找到三个候选,每个请求有 8,000 输入和 500 输出 token,并包括供应商 ID、估算成本和来源。