Gemini 3 系列多模态 API 实战 · 免费额度与定价对比 · 国内访问方案(2026 最新)
Gemini 3 由 Google DeepMind 推出,原生多模态(文本 / 图像 / 音频 / 视频输入),并引入 thinking_level 参数控制推理深度。当前在 Google AI Studio 与 Vertex AI 两条渠道提供,定价一致、配额不同。
| 模型 | 定位 | 上下文 | 免费层 | 输入 / 输出(≤200K) |
|---|---|---|---|---|
| Gemini 3.1 Pro | 最新旗舰推理 | 2M | 无 | $2.00 / $12.00 |
| Gemini 3 Pro | 强推理 | 2M | 无 | $2.00 / $12.00 |
| Gemini 3 Flash | 高速高性价比 | 1M | 有 | $0.50 / $3.00 |
| Gemini 2.5 Flash | 遗留稳定、最便宜 | 1M | 有 | $0.075 / $0.30 |
注:价格为每百万 token 美元;上下文超过 200K 时 Pro 涨到 $4/$18、Flash 涨到 $1/$6。缓存输入约再打 9 折(Pro $0.20/M、Flash $0.05/M)。
ai.google.dev 与 cloud.google.com(Vertex AI)在中国大陆不可直连。直接调用会出现超时 / 403。本指南的「官方文档」链接也需境外网络才能打开——下面给出合规可用的方案。
在境外合规云服务器(如合规地区的云主机)上部署一个后端代理,前端通过你自己的后端转发到 Gemini API。密钥只存于你自己的服务器,不交给任何第三方。
如果你的用户主要在国内,直接选国内大模型更稳更快、且合规:
以上在本站 tutorials 均有接入卡片,点击即可跳转对应指南。
以下示例假设你已通过合规通道拿到可用的 API Key,并在环境变量中设置 GEMINI_API_KEY。新项目推荐官方 google-genai SDK。
import os
from google import genai
client = genai.Client(api_key=os.environ["GEMINI_API_KEY"])
response = client.models.generate_content(
model="gemini-3-flash", # 或 gemini-3-pro / gemini-3.1-pro
contents="用一句话解释什么是多模态大模型"
)
print(response.text)
# 控制推理深度(Gemini 3 特性)
resp2 = client.models.generate_content(
model="gemini-3-pro",
contents="证明根号 2 是无理数",
config={"thinking_level": "high"} # low / medium / high
)
print(resp2.text)
from google import genai
from google.genai import types
import io
client = genai.Client(api_key=os.environ["GEMINI_API_KEY"])
image_bytes = open("chart.png", "rb").read()
response = client.models.generate_content(
model="gemini-3-flash",
contents=[
"这张图讲了什么?",
types.Part.from_bytes(data=image_bytes, mime_type="image/png")
]
)
print(response.text)
curl "https://你的合规网关/v1beta/models/gemini-3-flash:generateContent?key=$GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"你好,介绍一下你自己"}]}]}'
说明:示例中的 endpoint 写「你的合规网关」是因为官方域名国内不可直连;若你在境外环境直连,把前缀换成 https://generativelanguage.googleapis.com 即可(需境外网络)。
| 模型 | 输入 ≤200K | 输出 ≤200K | 输入 >200K | 输出 >200K | 缓存输入 |
|---|---|---|---|---|---|
| Gemini 3 / 3.1 Pro | $2.00 | $12.00 | $4.00 | $18.00 | $0.20/M |
| Gemini 3 Flash | $0.50 | $3.00 | $1.00 | $6.00 | $0.05/M |
| Gemini 2.5 Flash | $0.075 | $0.30 | $0.15 | $0.60 | $0.02/M |
对比竞品:GPT-5.2 为 $1.75/$14,Claude Opus 4.8 约 $15/$75——Gemini 3 Flash 在性价比上优势明显,但国内直连受限,需权衡网络成本。
Vertex AI 是 Google Cloud 上的企业级生成式 AI 平台,除 Gemini 模型外,还提供 IAM 权限、日志审计、安全合规、MLOps 流水线与数据驻留、企业级 SLA。适合对合规与稳定性要求高的生产应用。
主力是 Gemini 3 Pro(强推理、2M 上下文)与 Gemini 3 Flash(高速低成本、1M 上下文、有免费层);更新的 Gemini 3.1 Pro 与 3 Pro 同价($2/$12)。日常聊天、内容生成、代码助手默认用 Flash;只有最难的科研/前沿推理才需要 Pro。Gemini 2.5 Flash 仍可用且最便宜($0.075/$0.30)。
有。Google AI Studio 给 Gemini 3 Flash 提供免费层(约 15 次/分钟 + 每日配额),Pro 无免费层。此外免费层每月含 5000 次 Google Search 接地(Grounding)请求。
Google 官方 API 在中国大陆不可直连。合规做法:通过境外合规云服务器或企业合规专线中转;若追求国内合规可商用,建议改用国内平替——通义千问 Qwen、文心 ERNIE、智谱 GLM、DeepSeek、Kimi 等,本站均有对应接入指南。切勿把密钥交给来路不明的第三方代理转发。
Gemini 3 Flash 性价比极高(约 $0.5/$3),且是唯一保留生产级免费层的前沿模型,长上下文与多模态是强项;GPT-5.2、Claude 在复杂推理与代码上略占优但更贵。简单任务用 Flash,前沿推理按需切 Pro 或竞品。
普通 Gemini API 通过 Google AI Studio 接入,面向个人/小团队,有免费层与按量付费;Vertex AI 是 Google Cloud 上的企业级服务,提供 IAM、日志、安全合规、MLOps 与数据驻留、企业 SLA,适合生产级多模态应用,但需 Google Cloud 账号且大陆访问同样受限。
官方提供 Python(google-genai / google-generativeai)、Node.js、Go、REST 等 SDK。新项目推荐 google-genai 的 Client 写法(client.models.generate_content),支持多模态、流式与 thinking_level 推理深度参数。
400 多为模型名或参数写错;429 触发速率限制或免费层配额耗尽,降并发或绑定结算账号;403 为密钥无效/区域不可用。国内直连 403/超时通常是网络被墙,需走合规境外通道。