大模型 API 价格对比 · 免费额度一站汇总

AI大模型价格对比免费额度一站直达

实时对比 GPT、Claude、DeepSeek 等 50+ 大模型 API 价格、上下文窗口与能力,汇总免费额度渠道,帮你低成本接入 AI。

272+
大模型收录
1342+
AI 资源精选
10
智能分类
12
每日更新资讯

价格一目了然

全网导航站少有的实时比价——一眼看清谁更省,别家给不了。

GPT-5.6 SolOpenAI
输入价$4
输出价$20
上下文1M
完整比价 →
Kimi K3月之暗面
输入价$3
输出价$15
上下文1M
完整比价 →
DeepSeek V4 ProDeepSeek
输入价$1.25
输出价$3.75
上下文1M
完整比价 →
/ 百万 tokens

热门AI分类

覆盖写作、绘图、办公、开发、视频、音频、搜索和智能体,快速直达热门入口。

热门AI大模型

2026 年 9 月最新发布与口碑旗舰,点击卡片查看详情、加入对比或直达官网。

Jev

TypeSafe AI

TypeSafe AI 发布的 System One 判断模型。不生成文本,仅返回带校准概率的类型化判断(Choice 选择 / Score 评分 / Noul 空值),专为分类、路由、评分、抽取、分支等自动化决策场景设计。并行计算带来极低延迟与成本,输出 token 永久免费。

上下文: - 输入: $0.042/M 输出: $0/M
classificationroutingscoringjudgment

Claude Mythos 5.1

Anthropic

Anthropic 2026-09-01 与 Fable 5.1 同期发布的「孪生模型」:同一套底层权重,但在生物与网络安全领域采用更宽松的护栏策略。仅通过 Project Glasswing(可信访问计划)向审核过的网络安全与生命科学机构开放,不接受个人申请;其能力同时支撑面向企业客户的 Claude Security 产品线。规格与 Fable 5.1 一致:1M 上下文、128K 最大输出、$10/$50 每百万 tokens、缓存读 $0.25。

上下文: 1M 输入: $10/M 输出: $50/M
chatvisionfunctionreasoning

Gemini 3.8 Flash Cyber

Google

Google 与 Gemini 3.8 Flash 同日(2026-09-02)发布的网络安全专用变体:聚焦漏洞检测与自动修补,面向安全运营与代码审计场景,可把安全扫描挂进 CI 流水线。与标准版同享介绍价 $0.75/$3.75 每百万 tokens(缓存 $0.075),2027-01-01 起恢复 $1.50/$7.50;1M 上下文、64K 输出。场景较窄,通用对话仍建议用标准版。

上下文: 1M 输入: $0.75/M 输出: $3.75/M
chatfunctionreasoningcoding

Muse Spark 1.3

Meta

Meta Superintelligence Labs 2026-09-02 发布的闭源多模态推理模型,主攻长周期智能体与编码:1M 上下文、131K 输出,输入 $1.25 / 输出 $4.25 每百万 tokens(缓存读 $0.15)。Meta 自测 DeepSWE v1.1 75.4、Terminal-Bench 2.1 88.8、MRCR 512K-1M 长文档召回 98.1;官方开放 xhigh 推理档,max 档待安全测试后放行。另设「贡献者」低价端点 $0.10/$0.20,代价是 Meta 可用你的流量训练模型。适合整仓检索、长文档一次性读完的场景。

上下文: 1M 输入: $1.25/M 输出: $4.25/M
chatvisionvideoaudio

Claude Fable 5.1

Anthropic

Anthropic 2026-09-01 发布的现役 Fable 档(Mythos 级)旗舰:与 Mythos 5.1 共享底层权重,仅安全护栏更严。1M 上下文、128K 最大输出,定价维持 $10/$50 每百万 tokens,但缓存读从 $1 降至 $0.25(降 75%),官方测算典型负载便宜约 25%、高度智能体化负载最高省 45%。Terminal-Bench-Science 0.1 由上代 24.7% 跃升至 52.6%,Terminal-Bench 4.0 达 55.8%。新增对话中逐条调节推理强度、内容溯源追踪与隐形水印。

上下文: 1M 输入: $10/M 输出: $50/M
chatvisionreasoningfunction

GPT-6 Astra

OpenAI

OpenAI 于 2026-09-03 发布的新一代旗舰模型,上下文 105 万 tokens(最大输入 922K),在计算机操作、软件工程、网络安全与科学研究等领域达到最先进水平,支持异步工具调用与执行中调整指令。

上下文: 1M 输入: $10/M 输出: $50/M
chatvisionfunctionreasoning

Gemini 3.8 Flash

Google

谷歌 2026-09-02 正式 GA(gemini-3.8-flash)的「最能干」Flash:长程软件工程与自主智能体,DeepSWE v1.1 73.7%、HLE-Verified 54.9%,支持低/中/高三档推理与 1M 上下文。介绍价 $0.75/$3.75 每百万 tokens(缓存 $0.075)持续至 2026-12-31,2027-01-01 起恢复 $1.50/$7.50;注意默认输出更冗长,实际任务成本约高 40%。

上下文: 1M 输入: $0.75/M 输出: $3.75/M
chatfunctionreasoning

星火 X2.5-4B

讯飞星火

科大讯飞词元星火于 2026-09-01 开源的端侧通用大模型,业界首个原生支持最长 100 万 Token 上下文的端侧模型,围绕智能体、代码、数学与指令遵循优化;权重已在 Hugging Face / GitHub 开放,支持 Ollama、vLLM、llama.cpp 等主流框架自部署,讯飞星辰 MaaS 平台 API 限时免费。

上下文: 1M 输入: $0/M 输出: $0/M
chatfunctionreasoning
查看全部模型

最近一周 AI 资讯

仅展示最近一周的 AI 行业动态、产品发布与趋势洞察。

☁️ 云服务推荐 广告
阿里云 AI 算力与大模型服务特惠
GPU 云服务器、百炼大模型平台、对象存储等新老用户专享折扣,跑模型、部署 Agent 的低成本起步方案。
前往领取优惠
🎁 Kimi 邀请福利 广告
Kimi 登月同行 · 注册领会员权益
通过邀请链接注册 Kimi,双方 100% 得奖,最高可得 1 年会员等值权益。
去 Kimi 领权益