Gemini 3.1 Pro API 怎么接入?
接入 Gemini 3.1 Pro API,先区分 Google 官方 Key 与服务商 Key,再核对模型 ID 和接口协议。本文提供 Python 示例、官方价格档位及费用计算方法,并说明 403、429 的排查方向。
只想找 Gemini API 入口?先看这里
- 获取 Google 官方 Key:进入 Google AI Studio,按官方快速入门配置。
- 选择当前模型:看 Google 模型目录与弃用时间表,不要把旧教程里的模型 ID 当成最新推荐。
- 查国内接入的通用问题:看 Gemini API 国内接入指南。
本页仍专门解释 Gemini 3.1 Pro 的接入与价格口径。 它不是所有 Gemini 模型的统一配置表;复制示例前,先确认你所用平台仍提供该模型,且 Key、协议和模型 ID 配套。入口于 2026-09-09 核查,下面价格表保留原核查日期。
接入 Gemini 3.1 Pro API,先确认 Key、端点和模型 ID 属于同一平台。 Google 官方模型代码是 gemini-3.1-pro-preview;通过聚合服务接入时,ID 和可用功能以该服务的目录为准。不要混用 Google Key 与第三方端点。
先选接入方式
| 方式 | Key 从哪里获取 | 要检查什么 |
|---|---|---|
| Google 官方 API | Google AI Studio | 账号和区域可用性、项目计费、模型权限 |
| OfoxAI 等服务商 | 所选服务的控制台 | 模型 ID、价格、协议、账户限额 |
国内使用先核对 Google 支持区域 与实际账号条件。网页能打开不代表项目拥有模型访问权限;第三方服务的 Key 也不能用于 Google 官方端点。
本文用 OfoxAI 的 OpenAI 兼容接口演示。先在 模型目录 和控制台确认模型对你的账户可用,再创建 API Key。
用 Python 发起第一次调用
安装 SDK:
python -m pip install openai
把 Key 存入本地环境变量 OFOXAI_API_KEY;OFOXAI_MODEL 填控制台确认的模型 ID,例如目录中的 google/gemini-3.1-pro-preview。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["OFOXAI_API_KEY"],
base_url="https://api.ofox.run/v1",
timeout=60.0,
)
response = client.chat.completions.create(
model=os.environ["OFOXAI_MODEL"],
messages=[{"role": "user", "content": "解释二分查找的时间复杂度"}],
)
print(response.choices[0].message.content)
print(response.usage)
先确认返回文本,再接入业务。这个示例验证文本调用;视频、文件、搜索和工具调用是否透传,需要分别核对服务商的接口说明,不能从文本调用成功推断所有原生功能都支持。
Gemini 3.1 Pro API 多少钱
下表是 Google 官方标准调用价格,核对于 2026-09-07,单位为美元/百万 token。它不是 OfoxAI 或其他服务商的报价。
| 单次提示词长度 | 输入 | 输出(含思考 token) |
|---|---|---|
| 不超过 200K token | $2 | $12 |
| 超过 200K token | $4 | $18 |
来源:Google Gemini API 定价。缓存、搜索等功能另有计费规则;通过服务商调用时,以其控制台单价与实际账单为准。
每天 100 次调用大约花多少
假设每次输入 2,000 token、计费输出共 500 token,使用上表短提示词标准价格,且没有其他费用:
每次 = 2,000 / 1,000,000 × $2 + 500 / 1,000,000 × $12
= $0.004 + $0.006 = $0.01
每天 100 次 = $1.00
30 天 = $30.00
计费输出包含思考 token,不能只数最终显示的答案。实际成本还取决于失败重试、输入长度和所用服务的计费方式,应以返回用量和账单核对。
哪些任务适合尝试
Google 模型文档 列出的输入包括文本、图片、视频、音频和 PDF,输入上限为 1,048,576 token、输出上限为 65,536 token。
可以用它评估长文档检索、多模态分析和复杂工具流程。大上下文不等于可以无损处理任意规模代码仓库;先计算实际 token,并用已知答案检查遗漏。服务商接口是否支持对应输入格式,也需要单独确认。
选型时使用同一组业务样本比较正确率、延迟和每次任务费用。不要把不同测试条件下的榜单分数直接当作实际项目的胜率。
常见报错怎么查
| 报错 | 排查方向 |
|---|---|
| 401 | Key 是否属于当前平台,环境变量是否加载 |
| 403 / PERMISSION_DENIED | 项目权限、账号或区域条件,以及模型访问授权 |
| 模型不存在或不可用 | 从当前目录复制完整 ID,确认模型状态 |
| 429 / RESOURCE_EXHAUSTED | 配额、速率、计费或上游限制,结合错误正文判断 |
| 输入过长 | 检查输入 token、端点实际限制,再缩短或分块 |
不要把 403 一律归为模型名拼错,也不要给所有账户套用固定 RPM。429 的等待与重试方法见 429 Too Many Requests 怎么解决,其他错误见 API 报错速查。
常见问题
- Gemini 3.1 Pro API 的模型 ID 是什么?
- Google 官方模型代码是 gemini-3.1-pro-preview。聚合服务可能带 google/ 前缀,应从所用平台当前目录复制,不要混用 Key 与端点。
- Gemini 3.1 Pro API 多少钱?
- Google 标准调用在提示词不超过 200K token 时,输入每百万 token 2 美元、输出 12 美元;超过 200K 时为 4 美元和 18 美元。输出包含思考 token,服务商报价需另查。
- 通过兼容接口能使用所有 Gemini 功能吗?
- 不能仅凭文本调用成功判断。视频、文件、搜索和工具调用等功能需要逐项核对所用服务商的支持情况。


