让你看懂钱是怎么花掉的

帮你算算牛马的血汗钱是如何被薅掉的

  • 两个模型
  • 两种计算方式
  • 一眼看清
场景
一个任务约几轮
模型(最多比 2 个)
我的预算
¥ 元 / 月
每天工作
小时 / 天(0.5–16)

怎么算的?参数从哪来?

怎么算的:一个任务 = 一个会话 = 一件事做完(如「改一个功能」)。 先按场景算每一次请求的成本(输入 token × 输入价 + 输出 token × 输出价, 输入里可命中缓存的部分按缓存价计),再乘以这一档的轮数得到一个任务的成本。
两个维度是分开的:场景决定「每次请求有多重」,轮数决定「这件事要做几轮」。 一次往返的耗时由场景决定、不随轮数变化,所以每小时的花费与轮数无关, 轮数只影响「一笔预算能做多少个任务」。
参数出处:9 类场景的 token 与耗时为人工基准(当前假设见上方提示,悬浮可看), 其中「编程智能体」来自站内实测(163 次请求 / $1.5869 / 一小时改真实项目); 四档轮数来自 OpenRouter 会话成本榜的跨档实测比值。
缓存命中率 0.9 是我们的预估值,不是实测值。 取90% 的依据是公开实测——agent 与多轮场景普遍在 90% 上下 (Z.ai GLM-4.7 98.6%、Kimi K2.5 92.8%、GPT-5.5 92.7%)。
⚠️这个数会让结果偏向低估:命中率越高,缓存价(0.1×)占比更大,算出来的钱越少。 而且同款模型换供应商能差 4 倍(Opus 4.7:Anthropic 直连 79.1% vs Bedrock 仅 1.2%), 低价位供应商常是 0%。你的实际命中率取决于用什么工具,请以自己账单为准。 无缓存价的模型一律按全价计,不受此值影响。
另一个偏差方向:上表用各模型的挂牌价。实际通过 OpenRouter 走不同上游时, 有效价与挂牌价差异很大,本站无法预知你实际会路由到哪一家。
固定汇率 1 美元 ≈ 7.2 元(与全站一致),月花费按 22 个工作日折算, 未含厂商阶梯折扣与 OpenRouter 等平台服务费。实际支出受使用方式影响较大,结果仅供决策参考。

热门大模型 API 价格速览

按综合评分榜前 20 名排列,每日随榜单更新。缺少价格的模型暂不参与费用估算,单价单位:美元 / 百万 token。

模型厂商输入输出缓存输入月 500 万输出 token 估算对比
Claude Opus 5.5Anthropic$4$20$0.2$100
Claude Fable 5.1Anthropic$10$50$0.25$250
GPT-6.1 SolOpenAI$2$10$0.1$50
Claude Sonnet 5.5Anthropic$2$10$0.1$50
Claude Opus 5Anthropic$5$25$0.5$125
GPT-6 AstraOpenAI$10$50$1$250
Muse Spark 1.3Meta$1.25$4.25$0.15$21.25
GPT-5.6 SolOpenAI$4$20$0.4$100
MiMo-V2.6-Pro小米$0.435$0.87$0.0036$4.35
Kimi K3月之暗面$3$15$0.3$75
GPT-6 SolOpenAI$2$10$0.2$50
Gemini 3.7 Flash谷歌$0.75$3.75$0.075$18.75
Claude Opus 4.7Anthropic$5$25—$125
GPT-5.5OpenAI$5$30$0.5$150
Qwen3.8 Max阿里通义————
Gemini 3.8 Flash谷歌$0.75$3.75$0.075$18.75
Claude Opus 4.8Anthropic$5$25—$125
MiMo-V2.6-Flash小米$0.14$0.28$0.0028$1.4000000000000001
Grok 4.6xAI$2$6$0.5$30
GLM-5.3智谱 AI————

月费用 = 输出单价 × 500 万 token 的粗估(未含输入与缓存),精确估算请用上方计算器。