2026-10-08最新大模型会话成本排行榜
「会话」= 一次完整的任务全程,用户与模型多轮来回,可能来回数十轮。它不是「一问一答」 —— 本页的「单轮问答成本」才是只问一次就结束的那种;本页其余三档都是多轮的。
「一次会话」指一次完整的真实调用记录,按往返轮数(用户消息条数)分四档:单轮、2-9 轮、10-49 轮、50 轮以上。
榜上每个数字是单次会话的平均成本 —— 准确说是中位数:把该模型在该档位下的每一次真实调用,把全部轮次的输入与输出 token 按各自单价累加,得到这次会话实际花了多少钱,再对所有会话取中位数。所以它是「跑一次要多少钱」,不是每百万 token 的标价,也不是单 token 均价。
每多一轮,整段上下文都要重发一遍,输入 token 因此随轮数累积。
榜单汇总点评:这张榜单最明显的反差,是“省钱冠军”会随会话长度换人:单轮和2—9轮由 Mistral Nemo 领跑,10—49轮则是 OpenAI 的 GPT-6 Luna;到了50轮以上,MiMo-V2.6-Flash以0.1778美元登顶,成本不到GPT-6 Luna的四分之三。它在单轮榜只排第19,长聊却冲到第一,像是专为耐力赛准备的选手。Google Gemini和Anthropic Claude在长会话榜也都未进前十。短问短答看单次账单,聊得越久,排名越可能洗牌。
超长会话成本(50轮以上)
MiMo-V2.6-Flash 一次 $0.1778,第二名 GPT-6 Luna 是 $0.2528。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 50 轮以上的一次会话,取其实际花费的中位数。长会话里上下文每轮整段重发,输入 token 随轮数累积,所以这一档的成本由输入侧主导。
共 33 个模型(国产 14),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|---|---|---|
| 1 | MiMo-V2.6-Flash | 小米 | $0.1778 |
| 2 | GPT-6 Luna | OpenAI | $0.2528 |
| 3 | DeepSeek V4 Flash 0731 | 深度求索 | $0.2724 |
| 4 | Muse Spark 1.3 Contributor | Meta | $0.2782 |
| 5 | GPT-5.6 Luna | OpenAI | $0.3530 |
| 6 | GLM-5.3-Flash | 智谱 AI | $0.4609 |
| 7 | Qwen3.8 Flash | 阿里通义 | $0.4828 |
| 8 | DeepSeek V4.1 Flash | 深度求索 | $0.5395 |
| 9 | MiMo-V2.6-Pro | 小米 | $0.5775 |
| 10 | Hy4 preview | 腾讯 | $1.2268 |
| 11 | Claude 4.5 Haiku (Reasoning) | Anthropic | $1.3188 |
| 12 | Qwen3.8-27B | 阿里通义 | $1.3580 |
| 13 | MiniMax M3 | MiniMax | $1.5475 |
| 14 | DeepSeek V4 Pro 0813 | 深度求索 | $1.7065 |
| 15 | GPT-6.1 Sol | OpenAI | $2.3025 |
| 16 | GPT-5.6 Terra | OpenAI | $2.7202 |
| 17 | Gemini 3.8 Flash | 谷歌 | $2.7818 |
| 18 | GPT-6 Sol | OpenAI | $3.0530 |
| 19 | GLM-5.2 | 智谱 AI | $3.0744 |
| 20 | Claude Sonnet 5 | Anthropic | $3.6341 |
| 21 | GLM-5.3 | 智谱 AI | $3.9654 |
| 22 | GPT-5.6 Sol | OpenAI | $4.3790 |
| 23 | Claude Sonnet 4.6 (Max) | Anthropic | $4.6199 |
| 24 | Claude Sonnet 5.5 | Anthropic | $5.5065 |
| 25 | Kimi K3 | 月之暗面 | $5.6573 |
| 26 | Qwen3.8 Max | 阿里通义 | $5.7241 |
| 27 | Grok 4.6 | xAI | $7.6370 |
| 28 | Claude Opus 5.5 | Anthropic | $9.0013 |
| 29 | Claude Opus 4.6 (Max) | Anthropic | $10.1712 |
| 30 | Claude Opus 5 | Anthropic | $11.0914 |
长会话成本(10-49轮)
GPT-6 Luna 一次 $0.0320,第二名 DeepSeek V4 Flash 0731 是 $0.0326。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 10 到 49 轮的一次会话,取其实际花费的中位数。轮数比单轮多,但上下文累积还没到长会话那个量级。
共 83 个模型(国产 33),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|---|---|---|
| 1 | GPT-6 Luna | OpenAI | $0.0320 |
| 2 | DeepSeek V4 Flash 0731 | 深度求索 | $0.0326 |
| 3 | GPT-4o mini | OpenAI | $0.0365 |
| 4 | Qwen3.7 Flash | 阿里通义 | $0.0374 |
| 5 | Muse Spark 1.3 Contributor | Meta | $0.0377 |
| 6 | Solar Pro 4 | upstage | $0.0386 |
| 7 | Gemini 3.5 Flash-Lite | 谷歌 | $0.0404 |
| 8 | MiMo-V2.6-Flash | 小米 | $0.0415 |
| 9 | GPT-4.1 mini | OpenAI | $0.0462 |
| 10 | Step 3.7 Flash | 阶跃星辰 | $0.0473 |
| 11 | GPT-5.6 Luna | OpenAI | $0.0475 |
| 12 | Hy3 | 腾讯 | $0.0505 |
| 13 | GPT-5 mini | OpenAI | $0.0566 |
| 14 | GLM-5.3-Flash | 智谱 AI | $0.0584 |
| 15 | Qwen3.6-35B-A3B | 阿里通义 | $0.0608 |
| 16 | Qwen3.8 Flash | 阿里通义 | $0.0617 |
| 17 | DeepSeek V4.1 Flash | 深度求索 | $0.0619 |
| 18 | Gemini 2.5 Flash | 谷歌 | $0.0689 |
| 19 | Nemotron 3 Super 120B A12B | 英伟达 | $0.0690 |
| 20 | DeepSeek V4 Flash Vision (Max) | 深度求索 | $0.0703 |
| 21 | Qwen3 Coder Next | 阿里通义 | $0.0704 |
| 22 | MiniMax M2.7 | MiniMax | $0.0731 |
| 23 | MiMo-V2.5-Pro | 小米 | $0.0777 |
| 24 | Qwen3.7 Plus | 阿里通义 | $0.0811 |
| 25 | GPT-6 Luna Pro | OpenAI | $0.0860 |
| 26 | Gemini 3 Flash (Reasoning) | 谷歌 | $0.0863 |
| 27 | Gemma 4 31B (Reasoning) | 谷歌 | $0.0926 |
| 28 | DeepSeek V3.2 | 深度求索 | $0.0954 |
| 29 | DeepSeek V3 0324 | 深度求索 | $0.1047 |
| 30 | DeepSeek V3.1 (Non-reasoning) | 深度求索 | $0.1135 |
中等会话成本(2-9轮)
Mistral Nemo 一次 $0.0006,第二名 Ling 3.0 Flash 是 $0.0008。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 2 到 9 轮的一次会话,取其实际花费的中位数。
共 116 个模型(国产 47),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|---|---|---|
| 1 | Mistral Nemo | Mistral | $0.0006 |
| 2 | Ling 3.0 Flash | 蚂蚁集团 InclusionAI | $0.0008 |
| 3 | GPT-OSS 20B | OpenAI | $0.0008 |
| 4 | Ling 3.0 Flash VL | 蚂蚁集团 InclusionAI | $0.0010 |
| 5 | Mercury 2.5 | Inception | $0.0018 |
| 6 | Laguna S 2.1 | poolside | $0.0018 |
| 7 | Qwen3 30B A3B 2507 Instruct | 阿里通义 | $0.0020 |
| 8 | GPT-5 nano | OpenAI | $0.0020 |
| 9 | GPT-4.1 nano | OpenAI | $0.0020 |
| 10 | Mistral Small 3.2 24B | Mistral | $0.0023 |
| 11 | Nemotron 3.5 Lightning | 英伟达 | $0.0023 |
| 12 | Qwen3 VL 32B (Reasoning) | 阿里通义 | $0.0025 |
| 13 | Qwen3.7 Flash | 阿里通义 | $0.0025 |
| 14 | Gemma 4 26B A4B (Reasoning) | 谷歌 | $0.0025 |
| 15 | Qwen3.5 Flash | 阿里通义 | $0.0027 |
| 16 | Solar Pro 4 | upstage | $0.0028 |
| 17 | GPT-OSS 120B | OpenAI | $0.0028 |
| 18 | Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning) | 谷歌 | $0.0032 |
| 19 | Qwen3 235B A22B 2507 Instruct (Reasoning) | 阿里通义 | $0.0033 |
| 20 | Mistral Small 4 (Reasoning) | Mistral AI | $0.0035 |
| 21 | GLM-4.7-Flash | 智谱 AI | $0.0035 |
| 22 | Llama 3.1 Instruct 8B | Meta | $0.0038 |
| 23 | GPT-4o mini | OpenAI | $0.0040 |
| 24 | MiMo-V2.5 | 小米 | $0.0041 |
| 25 | Qwen3 Coder 30B A3B Instruct | 阿里通义 | $0.0043 |
| 26 | Llama 3.3 Instruct 70B | Meta | $0.0045 |
| 27 | DeepSeek V4 Flash 0731 | 深度求索 | $0.0047 |
| 28 | GPT-5.4 nano | OpenAI | $0.0053 |
| 29 | GPT-6 Luna | OpenAI | $0.0054 |
| 30 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0060 |
单轮问答成本
Mistral Nemo 一次 $0.0000,第二名 GPT-4.1 nano 是 $0.0001。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
只有一轮的一次问答,取其实际花费的中位数。没有历史上下文,成本几乎全部来自输出 token。
共 94 个模型(国产 32),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|---|---|---|
| 1 | Mistral Nemo | Mistral | $0.0000 |
| 2 | GPT-4.1 nano | OpenAI | $0.0001 |
| 3 | uncensored | venice | $0.0001 |
| 4 | GPT-5.4 nano | OpenAI | $0.0001 |
| 5 | Ling 3.0 Flash | 蚂蚁集团 InclusionAI | $0.0001 |
| 6 | GPT-OSS 20B | OpenAI | $0.0001 |
| 7 | Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning) | 谷歌 | $0.0002 |
| 8 | Qwen3.7 Flash | 阿里通义 | $0.0003 |
| 9 | Gemma 4 26B A4B (Reasoning) | 谷歌 | $0.0004 |
| 10 | GPT-5.4 mini | OpenAI | $0.0004 |
| 11 | Mercury 2.5 | Inception | $0.0005 |
| 12 | GPT-OSS 120B | OpenAI | $0.0005 |
| 13 | GPT-5 nano | OpenAI | $0.0006 |
| 14 | Step 3.7 Flash | 阶跃星辰 | $0.0006 |
| 15 | MiMo-V2.5 | 小米 | $0.0007 |
| 16 | Qwen3 235B A22B 2507 Instruct (Reasoning) | 阿里通义 | $0.0007 |
| 17 | Hy3 | 腾讯 | $0.0008 |
| 18 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0010 |
| 19 | MiMo-V2.6-Flash | 小米 | $0.0010 |
| 20 | GPT-4o mini | OpenAI | $0.0011 |
| 21 | DeepSeek V4 Flash 0731 | 深度求索 | $0.0011 |
| 22 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0013 |
| 23 | DeepSeek V4 Flash Vision (Max) | 深度求索 | $0.0014 |
| 24 | Nemotron 3 Super 120B A12B | 英伟达 | $0.0014 |
| 25 | Gemma 4 31B (Reasoning) | 谷歌 | $0.0016 |
| 26 | Gemini 3.6 Flash | 谷歌 | $0.0016 |
| 27 | Gemini 3 Flash (Reasoning) | 谷歌 | $0.0017 |
| 28 | GPT-4.1 mini | OpenAI | $0.0018 |
| 29 | Qwen3.6-35B-A3B | 阿里通义 | $0.0019 |
| 30 | Llama 3.3 Instruct 70B | Meta | $0.0020 |
数据来源:OpenRouter (已由本站排序与聚合) · 许可 CC BY 4.0
数据更新于 2026-10-08 · 底表更新于 2026-10-08 00:00