GPT 哪家便宜?2026 主流大模型 API 价格对比
数据更新于 2026-08 · 价格单位:美元 / 每百万 tokens · 来源:ai-tokens.cn 模型库(53 个主流模型)
一句话结论:如果你只关心「最便宜」,GLM-4.7 FlashX、Qwen3.5 Flash、DeepSeek V4 Flash 是单价最低的一档;若要在「能力 + 价格」间平衡,DeepSeek V4 Pro 与 Gemini 3.1 Flash 是性价比首选。GPT 系列整体偏贵,适合对生态与稳定性要求高的场景。
主流大模型 API 价格对比(输入 / 输出,美元 / 百万 tokens)
| 模型 | 上下文窗口 | 输入价 | 输出价 | 免费额度 |
|---|---|---|---|---|
| GLM-4.7 FlashX | 200K | $0.07 | $0.43 | 有限免费 |
| Qwen3. * Flash | 1M | $0.10 | $0.40 | 有限免费 |
| DeepSeek V4 Flash | 1M | $0.14 | $0.28 | 免费可用 |
| Gemini 3.1 Flash | 1M | $0.25 | $1.50 | 有限免费 |
| Qwen3.6 Plus | 1M | $0.50 | $3.00 | 有限免费 |
| Claude Haiku 4.6 | 1M | $0.80 | $4.00 | — |
| GLM-5.1 | 200K | $1.40 | $4.40 | 有限免费 |
| DeepSeek V4 Pro | 1M | $1.74 | $3.48 | 部分免费 |
| Gemini 3.1 Pro | 1M | $2.00 | $12.00 | 有限免费 |
| GPT-5.4 | 1M | $2.50 | $15.00 | — |
注:价格为公开标价,实际以各厂商计费页为准;标注「有限免费 / 免费可用」的模型可先试用再决定是否付费。
省钱选型建议
- 极致低成本:用 GLM-4.7 FlashX、Qwen3.5 Flash、DeepSeek V4 Flash 处理高频、对质量不敏感的任务。
- 平衡之选:DeepSeek V4 Pro、Gemini 3.1 Flash 在推理与价格间更均衡,适合生产环境。
- 避免盲选 GPT:GPT 系列单价明显更高,除非你的场景强依赖其生态或合规要求。
- 善用免费额度:先用「免费额度」跑通链路,再按量付费;详见 免费额度汇总。
- 降低单位成本:开启提示词缓存、批量请求、缩短系统提示,可让实际花费再降 30%–70%。
常见问题
2026 年哪个大模型最便宜?
按单价,GLM-4.7 FlashX、Qwen3.5 Flash、DeepSeek V4 Flash 最低;综合能力下的低价首选是 DeepSeek V4 Pro 与 Gemini 3.1 Flash。
GPT 和 Claude 哪个更便宜?
GPT-5.4 输入 2.5$/输出 15$,Claude 同档相近或更高;预算敏感型更推荐 DeepSeek、Qwen、GLM。
有没有完全免费的大模型可用?
有,DeepSeek V4 Flash 免费可用,GLM/Qwen/Gemini/智谱等提供有限免费额度。
怎样估算我的调用成本?
用本站「Token 价格计算器」输入 token 量即可;长文本开启缓存、合并批量请求可显著降本。
上下文窗口越大越贵吗?
不一定。DeepSeek V4 Flash(1M)比 GPT-5.4(1M)便宜很多,选型应同时看单价与窗口。