2026-10-04最新大模型会话成本排行榜

「会话」= 一次完整的任务全程,用户与模型多轮来回,可能来回数十轮。它不是「一问一答」 —— 本页的「单轮问答成本」才是只问一次就结束的那种;本页其余三档都是多轮的。

「一次会话」指一次完整的真实调用记录,按往返轮数(用户消息条数)分四档:单轮、2-9 轮、10-49 轮、50 轮以上。

榜上每个数字是单次会话的平均成本 —— 准确说是中位数:把该模型在该档位下的每一次真实调用,把全部轮次的输入与输出 token 按各自单价累加,得到这次会话实际花了多少钱,再对所有会话取中位数。所以它是「跑一次要多少钱」,不是每百万 token 的标价,也不是单 token 均价。

每多一轮,整段上下文都要重发一遍,输入 token 因此随轮数累积。

超长会话成本(50轮以上)

MiMo-V2.5 一次 $0.1682,第二名 Muse Spark 1.3 Contributor 是 $0.2616。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。

往返 50 轮以上的一次会话,取其实际花费的中位数。长会话里上下文每轮整段重发,输入 token 随轮数累积,所以这一档的成本由输入侧主导。

#1 MiMo-V2.5 厂商:小米 实测中位会话成本:$0.1682 / 次1.MiMo-V2.50.1682#2 Muse Spark 1.3 Contributor 厂商:Meta 实测中位会话成本:$0.2616 / 次2.Muse Spark 1.3…0.2616#3 GPT-6 Luna (Max) 厂商:OpenAI 实测中位会话成本:$0.3168 / 次3.GPT-6 Luna (Max)0.3168#4 GPT-5.6 Luna (Max) 厂商:OpenAI 实测中位会话成本:$0.3355 / 次4.GPT-5.6 Luna (Max)0.3355#5 DeepSeek V4 Flash 0731 (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$0.3405 / 次5.DeepSeek V4 Flash…0.3405#6 GLM-5.3-Flash 厂商:智谱 AI 实测中位会话成本:$0.4398 / 次6.GLM-5.3-Flash0.4398#7 Qwen3.8 Flash 厂商:阿里通义 实测中位会话成本:$0.5351 / 次7.Qwen3.8 Flash0.5351#8 MiMo-V2.6-Pro 厂商:小米 实测中位会话成本:$0.5411 / 次8.MiMo-V2.6-Pro0.5411#9 DeepSeek V4.1 Flash (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$0.6411 / 次9.DeepSeek V4.1 Flash…0.6411#10 Hy4 preview 厂商:腾讯 实测中位会话成本:$1.1966 / 次10.Hy4 preview1.1966#11 Claude 4.5 Haiku (Reasoning) 厂商:Anthropic 实测中位会话成本:$1.3011 / 次11.Claude 4.5 Haiku…1.3011#12 MiniMax M3 厂商:MiniMax 实测中位会话成本:$1.5655 / 次12.MiniMax M31.5655#13 DeepSeek V4 Pro 0813 (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$1.7377 / 次13.DeepSeek V4 Pro 0813…1.7377#14 Qwen3.8-27B (Xhigh) 厂商:阿里通义 实测中位会话成本:$1.8303 / 次14.Qwen3.8-27B (Xhigh)1.8303#15 GLM-5.2 (max) 厂商:智谱 AI 实测中位会话成本:$2.6089 / 次15.GLM-5.2 (max)2.6089#16 GPT-5.6 Terra (max) 厂商:OpenAI 实测中位会话成本:$2.7272 / 次16.GPT-5.6 Terra (max)2.7272#17 Gemini 3.8 Flash (high) 厂商:谷歌 实测中位会话成本:$3.0226 / 次17.Gemini 3.8 Flash…3.0226#18 GPT-6 Sol (Max) 厂商:OpenAI 实测中位会话成本:$3.0292 / 次18.GPT-6 Sol (Max)3.0292#19 Claude Sonnet 5 (Adaptive Reasoning, Max Effort) 厂商:Anthropic 实测中位会话成本:$3.7693 / 次19.Claude Sonnet 5…3.7693#20 GLM-5.3 (Max) 厂商:智谱 AI 实测中位会话成本:$4.2273 / 次20.GLM-5.3 (Max)4.2273
共 32 个模型(国产 14),越靠前越省
#模型厂商每会话成本
1MiMo-V2.5小米$0.1682
2Muse Spark 1.3 ContributorMeta$0.2616
3GPT-6 Luna (Max)OpenAI$0.3168
4GPT-5.6 Luna (Max)OpenAI$0.3355
5DeepSeek V4 Flash 0731 (Reasoning, Max Effort)深度求索$0.3405
6GLM-5.3-Flash智谱 AI$0.4398
7Qwen3.8 Flash阿里通义$0.5351
8MiMo-V2.6-Pro小米$0.5411
9DeepSeek V4.1 Flash (Reasoning, Max Effort)深度求索$0.6411
10Hy4 preview腾讯$1.1966
11Claude 4.5 Haiku (Reasoning)Anthropic$1.3011
12MiniMax M3MiniMax$1.5655
13DeepSeek V4 Pro 0813 (Reasoning, Max Effort)深度求索$1.7377
14Qwen3.8-27B (Xhigh)阿里通义$1.8303
15GLM-5.2 (max)智谱 AI$2.6089
16GPT-5.6 Terra (max)OpenAI$2.7272
17Gemini 3.8 Flash (high)谷歌$3.0226
18GPT-6 Sol (Max)OpenAI$3.0292
19Claude Sonnet 5 (Adaptive Reasoning, Max Effort)Anthropic$3.7693
20GLM-5.3 (Max)智谱 AI$4.2273
21Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)Anthropic$4.4083
22GPT-5.6 Sol (max)OpenAI$4.6682
23Kimi K3 (Max)月之暗面$5.6619
24Qwen3.8 Max阿里通义$6.0663
25Grok 4.6 (high)xAI$7.0299
26Claude Opus 4.6Anthropic$9.0627
27Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)Anthropic$9.1850
28Claude Opus 4.8 (Adaptive Reasoning, Max Effort)Anthropic$9.6190
29Claude Opus 5 (Adaptive Reasoning, Max Effort)Anthropic$10.5850
30GPT-6 Astra (max)OpenAI$19.5576

长会话成本(10-49轮)

MiMo-V2.5 一次 $0.0282,第二名 Muse Spark 1.3 Contributor 是 $0.0336。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。

往返 10 到 49 轮的一次会话,取其实际花费的中位数。轮数比单轮多,但上下文累积还没到长会话那个量级。

#1 MiMo-V2.5 厂商:小米 实测中位会话成本:$0.0282 / 次1.MiMo-V2.50.0282#2 Muse Spark 1.3 Contributor 厂商:Meta 实测中位会话成本:$0.0336 / 次2.Muse Spark 1.3…0.0336#3 GPT-6 Luna (Max) 厂商:OpenAI 实测中位会话成本:$0.0348 / 次3.GPT-6 Luna (Max)0.0348#4 Qwen3.7 Flash 厂商:阿里通义 实测中位会话成本:$0.0349 / 次4.Qwen3.7 Flash0.0349#5 DeepSeek V4 Flash 0731 (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$0.0359 / 次5.DeepSeek V4 Flash…0.0359#6 MiMo-V2.6-Flash 厂商:小米 实测中位会话成本:$0.0382 / 次6.MiMo-V2.6-Flash0.0382#7 GPT-5.6 Luna (Max) 厂商:OpenAI 实测中位会话成本:$0.0441 / 次7.GPT-5.6 Luna (Max)0.0441#8 Hy3 厂商:腾讯 实测中位会话成本:$0.0474 / 次8.Hy30.0474#9 Qwen3 Coder 30B A3B Instruct 厂商:阿里通义 实测中位会话成本:$0.0500 / 次9.Qwen3 Coder 30B A3B…0.05#10 Step 3.7 Flash 厂商:阶跃星辰 实测中位会话成本:$0.0503 / 次10.Step 3.7 Flash0.0503#11 GPT-4.1 mini 厂商:OpenAI 实测中位会话成本:$0.0531 / 次11.GPT-4.1 mini0.0531#12 GLM-5.3-Flash 厂商:智谱 AI 实测中位会话成本:$0.0543 / 次12.GLM-5.3-Flash0.0543#13 GPT-5 mini (high) 厂商:OpenAI 实测中位会话成本:$0.0571 / 次13.GPT-5 mini (high)0.0571#14 DeepSeek V4 Flash Vision Exp 厂商:深度求索 实测中位会话成本:$0.0596 / 次14.DeepSeek V4 Flash…0.0596#15 Qwen3.8 Flash 厂商:阿里通义 实测中位会话成本:$0.0630 / 次15.Qwen3.8 Flash0.063#16 Qwen3.6-35B-A3B (Reasoning) 厂商:阿里通义 实测中位会话成本:$0.0636 / 次16.Qwen3.6-35B-A3B…0.0636#17 Nemotron 3 Super 120B A12B (Reasoning) 厂商:英伟达 实测中位会话成本:$0.0686 / 次17.Nemotron 3 Super…0.0686#18 Gemini 2.5 Flash 厂商:谷歌 实测中位会话成本:$0.0709 / 次18.Gemini 2.5 Flash0.0709#19 Qwen3 Coder Next 厂商:阿里通义 实测中位会话成本:$0.0711 / 次19.Qwen3 Coder Next0.0711#20 DeepSeek V4.1 Flash (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$0.0729 / 次20.DeepSeek V4.1 Flash…0.0729
共 83 个模型(国产 37),越靠前越省
#模型厂商每会话成本
1MiMo-V2.5小米$0.0282
2Muse Spark 1.3 ContributorMeta$0.0336
3GPT-6 Luna (Max)OpenAI$0.0348
4Qwen3.7 Flash阿里通义$0.0349
5DeepSeek V4 Flash 0731 (Reasoning, Max Effort)深度求索$0.0359
6MiMo-V2.6-Flash小米$0.0382
7GPT-5.6 Luna (Max)OpenAI$0.0441
8Hy3腾讯$0.0474
9Qwen3 Coder 30B A3B Instruct阿里通义$0.0500
10Step 3.7 Flash阶跃星辰$0.0503
11GPT-4.1 miniOpenAI$0.0531
12GLM-5.3-Flash智谱 AI$0.0543
13GPT-5 mini (high)OpenAI$0.0571
14DeepSeek V4 Flash Vision Exp深度求索$0.0596
15Qwen3.8 Flash阿里通义$0.0630
16Qwen3.6-35B-A3B (Reasoning)阿里通义$0.0636
17Nemotron 3 Super 120B A12B (Reasoning)英伟达$0.0686
18Gemini 2.5 Flash谷歌$0.0709
19Qwen3 Coder Next阿里通义$0.0711
20DeepSeek V4.1 Flash (Reasoning, Max Effort)深度求索$0.0729
21MiniMax M2.7MiniMax$0.0760
22GPT-6 Luna ProOpenAI$0.0773
23DeepSeek V3.2 (Reasoning)深度求索$0.0805
24Qwen3.7 Plus阿里通义$0.0808
25MiMo-V2.5-Pro小米$0.0820
26Gemini 3 Flash (Preview)谷歌$0.0916
27Gemma 4 31B (Reasoning)谷歌$0.0925
28Hy3 Preview腾讯$0.0953
29DeepSeek V3 0324深度求索$0.1058
30MiMo-V2.6-Pro小米$0.1084

中等会话成本(2-9轮)

Mistral Nemo 一次 $0.0007,第二名 Ling 3.0 Flash 是 $0.0008。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。

往返 2 到 9 轮的一次会话,取其实际花费的中位数。

#1 Mistral Nemo 厂商:Mistral 实测中位会话成本:$0.0007 / 次1.Mistral Nemo0.0007#2 Ling 3.0 Flash 厂商:蚂蚁集团 InclusionAI 实测中位会话成本:$0.0008 / 次2.Ling 3.0 Flash0.0008#3 GPT-OSS 20B (high) 厂商:OpenAI 实测中位会话成本:$0.0010 / 次3.GPT-OSS 20B (high)0.001#4 Laguna S 2.1 厂商:poolside 实测中位会话成本:$0.0017 / 次4.Laguna S 2.10.0017#5 Mercury 2.5 厂商:Inception 实测中位会话成本:$0.0019 / 次5.Mercury 2.50.0019#6 Mistral Small 3.2 24B 厂商:Mistral 实测中位会话成本:$0.0022 / 次6.Mistral Small 3.2…0.0022#7 GPT-5 nano 厂商:OpenAI 实测中位会话成本:$0.0022 / 次7.GPT-5 nano0.0022#8 Qwen3.7 Flash 厂商:阿里通义 实测中位会话成本:$0.0022 / 次8.Qwen3.7 Flash0.0022#9 Solar Pro 4 厂商:upstage 实测中位会话成本:$0.0023 / 次9.Solar Pro 40.0023#10 GPT-4.1 nano 厂商:OpenAI 实测中位会话成本:$0.0024 / 次10.GPT-4.1 nano0.0024#11 Qwen3 VL 32B Instruct 厂商:阿里通义 实测中位会话成本:$0.0026 / 次11.Qwen3 VL 32B…0.0026#12 Qwen3 30B A3B Instruct 2507 厂商:阿里通义 实测中位会话成本:$0.0027 / 次12.Qwen3 30B A3B…0.0027#13 GPT-OSS 120B (high) 厂商:OpenAI 实测中位会话成本:$0.0028 / 次13.GPT-OSS 120B (high)0.0028#14 Gemma 4 26B A4B (Reasoning) 厂商:谷歌 实测中位会话成本:$0.0030 / 次14.Gemma 4 26B A4B…0.003#15 Qwen3.5 Flash 厂商:阿里通义 实测中位会话成本:$0.0032 / 次15.Qwen3.5 Flash0.0032#16 GLM-4.7-Flash 厂商:智谱 AI 实测中位会话成本:$0.0034 / 次16.GLM-4.7-Flash0.0034#17 Mistral Small 4 (Reasoning) 厂商:Mistral 实测中位会话成本:$0.0036 / 次17.Mistral Small 4…0.0036#18 Gemini 2.5 Flash Lite 厂商:谷歌 实测中位会话成本:$0.0036 / 次18.Gemini 2.5 Flash…0.0036#19 Llama 3.1 Instruct 8B 厂商:Meta 实测中位会话成本:$0.0037 / 次19.Llama 3.1 Instruct…0.0037#20 Qwen3-235B-A22B 厂商:阿里通义 实测中位会话成本:$0.0040 / 次20.Qwen3-235B-A22B0.004
共 116 个模型(国产 47),越靠前越省
#模型厂商每会话成本
1Mistral NemoMistral$0.0007
2Ling 3.0 Flash蚂蚁集团 InclusionAI$0.0008
3GPT-OSS 20B (high)OpenAI$0.0010
4Laguna S 2.1poolside$0.0017
5Mercury 2.5Inception$0.0019
6Mistral Small 3.2 24BMistral$0.0022
7GPT-5 nanoOpenAI$0.0022
8Qwen3.7 Flash阿里通义$0.0022
9Solar Pro 4upstage$0.0023
10GPT-4.1 nanoOpenAI$0.0024
11Qwen3 VL 32B Instruct阿里通义$0.0026
12Qwen3 30B A3B Instruct 2507阿里通义$0.0027
13GPT-OSS 120B (high)OpenAI$0.0028
14Gemma 4 26B A4B (Reasoning)谷歌$0.0030
15Qwen3.5 Flash阿里通义$0.0032
16GLM-4.7-Flash智谱 AI$0.0034
17Mistral Small 4 (Reasoning)Mistral$0.0036
18Gemini 2.5 Flash Lite谷歌$0.0036
19Llama 3.1 Instruct 8BMeta$0.0037
20Qwen3-235B-A22B阿里通义$0.0040
21Llama 3.3 Instruct 70BMeta$0.0041
22Qwen3 Coder 30B A3B Instruct阿里通义$0.0042
23GPT-4o miniOpenAI$0.0042
24Muse Spark 1.2 ContributorMeta$0.0043
25DeepSeek V4 Flash 0731 (Reasoning, Max Effort)深度求索$0.0050
26GPT-5.4 nano (xhigh)OpenAI$0.0058
27GPT-6 Luna (Max)OpenAI$0.0060
28Gemini 3.1 Flash-Lite谷歌$0.0062
29Muse Spark 1.3 ContributorMeta$0.0064
30Hy3腾讯$0.0070

单轮问答成本

Mistral Nemo 一次 $0.0000,第二名 uncensored 是 $0.0001。同一模型在单轮和长会话上的成本能差上千倍 —— 标价便宜不等于用起来便宜。

只有一轮的一次问答,取其实际花费的中位数。没有历史上下文,成本几乎全部来自输出 token。

#1 Mistral Nemo 厂商:Mistral 实测中位会话成本:$0.0000 / 次1.Mistral Nemo0.0000#2 uncensored 厂商:venice 实测中位会话成本:$0.0001 / 次2.uncensored0.0001#3 GPT-5.4 nano (xhigh) 厂商:OpenAI 实测中位会话成本:$0.0001 / 次3.GPT-5.4 nano (xhigh)0.0001#4 GPT-OSS 20B (high) 厂商:OpenAI 实测中位会话成本:$0.0002 / 次4.GPT-OSS 20B (high)0.0002#5 Ling 3.0 Flash 厂商:蚂蚁集团 InclusionAI 实测中位会话成本:$0.0002 / 次5.Ling 3.0 Flash0.0002#6 Llama 3.1 Instruct 8B 厂商:Meta 实测中位会话成本:$0.0002 / 次6.Llama 3.1 Instruct…0.0002#7 Gemini 2.5 Flash Lite 厂商:谷歌 实测中位会话成本:$0.0003 / 次7.Gemini 2.5 Flash…0.0003#8 Mercury 2.5 厂商:Inception 实测中位会话成本:$0.0004 / 次8.Mercury 2.50.0004#9 Qwen3.7 Flash 厂商:阿里通义 实测中位会话成本:$0.0004 / 次9.Qwen3.7 Flash0.0004#10 Gemma 4 26B A4B (Reasoning) 厂商:谷歌 实测中位会话成本:$0.0004 / 次10.Gemma 4 26B A4B…0.0004#11 GPT-OSS 120B (high) 厂商:OpenAI 实测中位会话成本:$0.0005 / 次11.GPT-OSS 120B (high)0.0005#12 GPT-5 nano 厂商:OpenAI 实测中位会话成本:$0.0006 / 次12.GPT-5 nano0.0006#13 MiMo-V2.6-Flash 厂商:小米 实测中位会话成本:$0.0007 / 次13.MiMo-V2.6-Flash0.0007#14 MiMo-V2.5 厂商:小米 实测中位会话成本:$0.0008 / 次14.MiMo-V2.50.0008#15 Gemini 3.1 Flash-Lite 厂商:谷歌 实测中位会话成本:$0.0010 / 次15.Gemini 3.1…0.001#16 Qwen3-235B-A22B 厂商:阿里通义 实测中位会话成本:$0.0012 / 次16.Qwen3-235B-A22B0.0012#17 Gemini 3.1 Flash-Lite 厂商:谷歌 实测中位会话成本:$0.0013 / 次17.Gemini 3.1…0.0013#18 GPT-4o mini 厂商:OpenAI 实测中位会话成本:$0.0013 / 次18.GPT-4o mini0.0013#19 Step 3.7 Flash 厂商:阶跃星辰 实测中位会话成本:$0.0013 / 次19.Step 3.7 Flash0.0013#20 DeepSeek V4 Flash 0731 (Reasoning, Max Effort) 厂商:深度求索 实测中位会话成本:$0.0013 / 次20.DeepSeek V4 Flash…0.0013
共 93 个模型(国产 32),越靠前越省
#模型厂商每会话成本
1Mistral NemoMistral$0.0000
2uncensoredvenice$0.0001
3GPT-5.4 nano (xhigh)OpenAI$0.0001
4GPT-OSS 20B (high)OpenAI$0.0002
5Ling 3.0 Flash蚂蚁集团 InclusionAI$0.0002
6Llama 3.1 Instruct 8BMeta$0.0002
7Gemini 2.5 Flash Lite谷歌$0.0003
8Mercury 2.5Inception$0.0004
9Qwen3.7 Flash阿里通义$0.0004
10Gemma 4 26B A4B (Reasoning)谷歌$0.0004
11GPT-OSS 120B (high)OpenAI$0.0005
12GPT-5 nanoOpenAI$0.0006
13MiMo-V2.6-Flash小米$0.0007
14MiMo-V2.5小米$0.0008
15Gemini 3.1 Flash-Lite谷歌$0.0010
16Qwen3-235B-A22B阿里通义$0.0012
17Gemini 3.1 Flash-Lite谷歌$0.0013
18GPT-4o miniOpenAI$0.0013
19Step 3.7 Flash阶跃星辰$0.0013
20DeepSeek V4 Flash 0731 (Reasoning, Max Effort)深度求索$0.0013
21GPT-6 Luna (Max)OpenAI$0.0015
22Gemini 3 Flash (Preview)谷歌$0.0015
23Nemotron 3 Super 120B A12B (Reasoning)英伟达$0.0016
24Gemini 3.6 Flash (high)谷歌$0.0016
25Hy3腾讯$0.0016
26Gemma 4 31B (Reasoning)谷歌$0.0017
27DeepSeek V4 Flash Vision Exp深度求索$0.0018
28Llama 3.3 Instruct 70BMeta$0.0019
29Qwen3.6-35B-A3B (Reasoning)阿里通义$0.0019
30GPT-4.1 miniOpenAI$0.0021

数据更新于 2026-10-04 · 底表更新于 2026-10-04 00:00 · 来源 OpenRouter · 本站仅做聚合与排序,测量方为 OpenRouter