2026-10-04最新大模型会话成本排行榜
「会话」= 一次完整的任务全程,用户与模型多轮来回,可能来回数十轮。它不是「一问一答」 —— 本页的「单轮问答成本」才是只问一次就结束的那种;本页其余三档都是多轮的。
「一次会话」指一次完整的真实调用记录,按往返轮数(用户消息条数)分四档:单轮、2-9 轮、10-49 轮、50 轮以上。
榜上每个数字是单次会话的平均成本 —— 准确说是中位数:把该模型在该档位下的每一次真实调用,把全部轮次的输入与输出 token 按各自单价累加,得到这次会话实际花了多少钱,再对所有会话取中位数。所以它是「跑一次要多少钱」,不是每百万 token 的标价,也不是单 token 均价。
每多一轮,整段上下文都要重发一遍,输入 token 因此随轮数累积。
超长会话成本(50轮以上)
MiMo-V2.5 一次 $0.1682,第二名 Muse Spark 1.3 Contributor 是 $0.2616。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 50 轮以上的一次会话,取其实际花费的中位数。长会话里上下文每轮整段重发,输入 token 随轮数累积,所以这一档的成本由输入侧主导。
共 32 个模型(国产 14),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|
| 1 | MiMo-V2.5 | 小米 | $0.1682 |
| 2 | Muse Spark 1.3 Contributor | Meta | $0.2616 |
| 3 | GPT-6 Luna (Max) | OpenAI | $0.3168 |
| 4 | GPT-5.6 Luna (Max) | OpenAI | $0.3355 |
| 5 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 深度求索 | $0.3405 |
| 6 | GLM-5.3-Flash | 智谱 AI | $0.4398 |
| 7 | Qwen3.8 Flash | 阿里通义 | $0.5351 |
| 8 | MiMo-V2.6-Pro | 小米 | $0.5411 |
| 9 | DeepSeek V4.1 Flash (Reasoning, Max Effort) | 深度求索 | $0.6411 |
| 10 | Hy4 preview | 腾讯 | $1.1966 |
| 11 | Claude 4.5 Haiku (Reasoning) | Anthropic | $1.3011 |
| 12 | MiniMax M3 | MiniMax | $1.5655 |
| 13 | DeepSeek V4 Pro 0813 (Reasoning, Max Effort) | 深度求索 | $1.7377 |
| 14 | Qwen3.8-27B (Xhigh) | 阿里通义 | $1.8303 |
| 15 | GLM-5.2 (max) | 智谱 AI | $2.6089 |
| 16 | GPT-5.6 Terra (max) | OpenAI | $2.7272 |
| 17 | Gemini 3.8 Flash (high) | 谷歌 | $3.0226 |
| 18 | GPT-6 Sol (Max) | OpenAI | $3.0292 |
| 19 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort) | Anthropic | $3.7693 |
| 20 | GLM-5.3 (Max) | 智谱 AI | $4.2273 |
| 21 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) | Anthropic | $4.4083 |
| 22 | GPT-5.6 Sol (max) | OpenAI | $4.6682 |
| 23 | Kimi K3 (Max) | 月之暗面 | $5.6619 |
| 24 | Qwen3.8 Max | 阿里通义 | $6.0663 |
| 25 | Grok 4.6 (high) | xAI | $7.0299 |
| 26 | Claude Opus 4.6 | Anthropic | $9.0627 |
| 27 | Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback) | Anthropic | $9.1850 |
| 28 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | Anthropic | $9.6190 |
| 29 | Claude Opus 5 (Adaptive Reasoning, Max Effort) | Anthropic | $10.5850 |
| 30 | GPT-6 Astra (max) | OpenAI | $19.5576 |
长会话成本(10-49轮)
MiMo-V2.5 一次 $0.0282,第二名 Muse Spark 1.3 Contributor 是 $0.0336。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 10 到 49 轮的一次会话,取其实际花费的中位数。轮数比单轮多,但上下文累积还没到长会话那个量级。
共 83 个模型(国产 37),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|
| 1 | MiMo-V2.5 | 小米 | $0.0282 |
| 2 | Muse Spark 1.3 Contributor | Meta | $0.0336 |
| 3 | GPT-6 Luna (Max) | OpenAI | $0.0348 |
| 4 | Qwen3.7 Flash | 阿里通义 | $0.0349 |
| 5 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 深度求索 | $0.0359 |
| 6 | MiMo-V2.6-Flash | 小米 | $0.0382 |
| 7 | GPT-5.6 Luna (Max) | OpenAI | $0.0441 |
| 8 | Hy3 | 腾讯 | $0.0474 |
| 9 | Qwen3 Coder 30B A3B Instruct | 阿里通义 | $0.0500 |
| 10 | Step 3.7 Flash | 阶跃星辰 | $0.0503 |
| 11 | GPT-4.1 mini | OpenAI | $0.0531 |
| 12 | GLM-5.3-Flash | 智谱 AI | $0.0543 |
| 13 | GPT-5 mini (high) | OpenAI | $0.0571 |
| 14 | DeepSeek V4 Flash Vision Exp | 深度求索 | $0.0596 |
| 15 | Qwen3.8 Flash | 阿里通义 | $0.0630 |
| 16 | Qwen3.6-35B-A3B (Reasoning) | 阿里通义 | $0.0636 |
| 17 | Nemotron 3 Super 120B A12B (Reasoning) | 英伟达 | $0.0686 |
| 18 | Gemini 2.5 Flash | 谷歌 | $0.0709 |
| 19 | Qwen3 Coder Next | 阿里通义 | $0.0711 |
| 20 | DeepSeek V4.1 Flash (Reasoning, Max Effort) | 深度求索 | $0.0729 |
| 21 | MiniMax M2.7 | MiniMax | $0.0760 |
| 22 | GPT-6 Luna Pro | OpenAI | $0.0773 |
| 23 | DeepSeek V3.2 (Reasoning) | 深度求索 | $0.0805 |
| 24 | Qwen3.7 Plus | 阿里通义 | $0.0808 |
| 25 | MiMo-V2.5-Pro | 小米 | $0.0820 |
| 26 | Gemini 3 Flash (Preview) | 谷歌 | $0.0916 |
| 27 | Gemma 4 31B (Reasoning) | 谷歌 | $0.0925 |
| 28 | Hy3 Preview | 腾讯 | $0.0953 |
| 29 | DeepSeek V3 0324 | 深度求索 | $0.1058 |
| 30 | MiMo-V2.6-Pro | 小米 | $0.1084 |
中等会话成本(2-9轮)
Mistral Nemo 一次 $0.0007,第二名 Ling 3.0 Flash 是 $0.0008。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
往返 2 到 9 轮的一次会话,取其实际花费的中位数。
共 116 个模型(国产 47),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|
| 1 | Mistral Nemo | Mistral | $0.0007 |
| 2 | Ling 3.0 Flash | 蚂蚁集团 InclusionAI | $0.0008 |
| 3 | GPT-OSS 20B (high) | OpenAI | $0.0010 |
| 4 | Laguna S 2.1 | poolside | $0.0017 |
| 5 | Mercury 2.5 | Inception | $0.0019 |
| 6 | Mistral Small 3.2 24B | Mistral | $0.0022 |
| 7 | GPT-5 nano | OpenAI | $0.0022 |
| 8 | Qwen3.7 Flash | 阿里通义 | $0.0022 |
| 9 | Solar Pro 4 | upstage | $0.0023 |
| 10 | GPT-4.1 nano | OpenAI | $0.0024 |
| 11 | Qwen3 VL 32B Instruct | 阿里通义 | $0.0026 |
| 12 | Qwen3 30B A3B Instruct 2507 | 阿里通义 | $0.0027 |
| 13 | GPT-OSS 120B (high) | OpenAI | $0.0028 |
| 14 | Gemma 4 26B A4B (Reasoning) | 谷歌 | $0.0030 |
| 15 | Qwen3.5 Flash | 阿里通义 | $0.0032 |
| 16 | GLM-4.7-Flash | 智谱 AI | $0.0034 |
| 17 | Mistral Small 4 (Reasoning) | Mistral | $0.0036 |
| 18 | Gemini 2.5 Flash Lite | 谷歌 | $0.0036 |
| 19 | Llama 3.1 Instruct 8B | Meta | $0.0037 |
| 20 | Qwen3-235B-A22B | 阿里通义 | $0.0040 |
| 21 | Llama 3.3 Instruct 70B | Meta | $0.0041 |
| 22 | Qwen3 Coder 30B A3B Instruct | 阿里通义 | $0.0042 |
| 23 | GPT-4o mini | OpenAI | $0.0042 |
| 24 | Muse Spark 1.2 Contributor | Meta | $0.0043 |
| 25 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 深度求索 | $0.0050 |
| 26 | GPT-5.4 nano (xhigh) | OpenAI | $0.0058 |
| 27 | GPT-6 Luna (Max) | OpenAI | $0.0060 |
| 28 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0062 |
| 29 | Muse Spark 1.3 Contributor | Meta | $0.0064 |
| 30 | Hy3 | 腾讯 | $0.0070 |
单轮问答成本
Mistral Nemo 一次 $0.0000,第二名 uncensored 是 $0.0001。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。
只有一轮的一次问答,取其实际花费的中位数。没有历史上下文,成本几乎全部来自输出 token。
共 93 个模型(国产 32),越靠前越省
| # | 模型 | 厂商 | 每会话成本 |
|---|
| 1 | Mistral Nemo | Mistral | $0.0000 |
| 2 | uncensored | venice | $0.0001 |
| 3 | GPT-5.4 nano (xhigh) | OpenAI | $0.0001 |
| 4 | GPT-OSS 20B (high) | OpenAI | $0.0002 |
| 5 | Ling 3.0 Flash | 蚂蚁集团 InclusionAI | $0.0002 |
| 6 | Llama 3.1 Instruct 8B | Meta | $0.0002 |
| 7 | Gemini 2.5 Flash Lite | 谷歌 | $0.0003 |
| 8 | Mercury 2.5 | Inception | $0.0004 |
| 9 | Qwen3.7 Flash | 阿里通义 | $0.0004 |
| 10 | Gemma 4 26B A4B (Reasoning) | 谷歌 | $0.0004 |
| 11 | GPT-OSS 120B (high) | OpenAI | $0.0005 |
| 12 | GPT-5 nano | OpenAI | $0.0006 |
| 13 | MiMo-V2.6-Flash | 小米 | $0.0007 |
| 14 | MiMo-V2.5 | 小米 | $0.0008 |
| 15 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0010 |
| 16 | Qwen3-235B-A22B | 阿里通义 | $0.0012 |
| 17 | Gemini 3.1 Flash-Lite | 谷歌 | $0.0013 |
| 18 | GPT-4o mini | OpenAI | $0.0013 |
| 19 | Step 3.7 Flash | 阶跃星辰 | $0.0013 |
| 20 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 深度求索 | $0.0013 |
| 21 | GPT-6 Luna (Max) | OpenAI | $0.0015 |
| 22 | Gemini 3 Flash (Preview) | 谷歌 | $0.0015 |
| 23 | Nemotron 3 Super 120B A12B (Reasoning) | 英伟达 | $0.0016 |
| 24 | Gemini 3.6 Flash (high) | 谷歌 | $0.0016 |
| 25 | Hy3 | 腾讯 | $0.0016 |
| 26 | Gemma 4 31B (Reasoning) | 谷歌 | $0.0017 |
| 27 | DeepSeek V4 Flash Vision Exp | 深度求索 | $0.0018 |
| 28 | Llama 3.3 Instruct 70B | Meta | $0.0019 |
| 29 | Qwen3.6-35B-A3B (Reasoning) | 阿里通义 | $0.0019 |
| 30 | GPT-4.1 mini | OpenAI | $0.0021 |
数据更新于 2026-10-04 · 底表更新于 2026-10-04 00:00 · 来源 OpenRouter · 本站仅做聚合与排序,测量方为 OpenRouter