实用工具
输入
结果
结果会显示在这里。在大模型上做一个功能之前,总得先回答一个问题:一千次、一百万次这样的请求要花多少钱?填入单次请求的输入、输出 Token 数和预计请求次数——或者直接粘贴提示词让工具来数——它会按你选的模型计价,同时列出其余 45 个模型的费用,从便宜到贵排序。价格来自 LiteLLM(BerriAI/litellm,MIT)维护的价格表的一份带日期的快照;LiteLLM 是很多团队用来统计模型开销的开源网关,每次结果都会注明快照日期。
它是怎么工作的
- 费用 = 输入 Token × 输入单价 + 输出 Token × 输出单价(单价按每百万 Token 计),再乘以请求次数;统计栏会把总额拆成输入和输出两部分。
- 粘贴的文本用 o200k_base 计数:对 OpenAI 的 GPT-4o、GPT-4.1、GPT-5 系列是精确值,对其他厂商是估算;有文本时,输入 Token 数那一栏会被忽略。
- 单次请求的输入超过厂商的长上下文门槛时自动切换到长上下文价格——例如 GPT-5.4 到 5.6 超过 272K、Gemini 2.5 Pro、Gemini 3.1 Pro 和 Grok 超过 200K——通义千问的阶梯价格也按档计算。
- 对比表用 ▶ 标出你选的模型;如果某个模型的上下文窗口放不下这次请求的输入加输出,会在旁边打 ✗。
你的数据去了哪里
哪也没去。本工具完全在你的浏览器里运行:你粘贴的文本由页面处理,不会传输到任何服务器,也不会写进任何日志。
本工具免费且无需登录,运行结果只存在于你当前的页面里,不会被保存到任何地方。
它要花多少
本工具完全免费,不需要登录,也不消耗积分。
常见问题
- 价格是最新的吗?
- 是一份快照,日期写在结果里。各家降价频繁,每隔几周就有新模型,所以签合同或做预算审批时,请以厂商官网价格页为准。快照取自 LiteLLM 的价格表,由人工更新,并非实时抓取。
- 包含缓存命中价和批量折扣吗?
- 不包含,所有输入 Token 都按标准价计算。厂商提供缓存输入价时,会在统计栏里单独列出,方便你估算重复前缀能省多少。批量接口(通常以 24 小时内返回为代价打五折)没有计算在内。
- 推理 Token 怎么算?
- o3、GPT-5、DeepSeek-reasoner、开启扩展思考的 Claude 等推理模型,会把看不见的思考过程按输出 Token 计费。请把预计的思考量加进输出 Token 数里;真实响应里的 usage 字段会告诉你一次典型请求用了多少,本站的 SSE 流解析工具可以直接读出来。
- 为什么 DeepSeek V4 标的是 Fireworks,Llama 标的是 Groq?
- 开源权重模型有很多托管方,价格各不相同,快照为每个模型选了一家有代表性的:Llama 3.1 和 3.3 用 Groq,Llama 4 Maverick 用 DeepInfra,DeepSeek V4 用 Fireworks。provider 一列写明了是谁的价格。
背后的开源项目
本工具是独立实现,并未打包第三方库。BerriAI/litellm(MIT)在代码层面做的是同一件事——如果你需要在自己的程序里实现它,从那里开始,而不是调用一个网页。
BerriAI/litellm也常被称作
- 大模型api价格计算
- token费用计算器
- openai api 价格
- deepseek api 价格
- claude api 费用
- llm cost calculator