Gemini 3.1 Pro API 怎么接入?

接入 Gemini 3.1 Pro API,先区分 Google 官方 Key 与服务商 Key,再核对模型 ID 和接口协议。本文提供 Python 示例、官方价格档位及费用计算方法,并说明 403、429 的排查方向。

Gemini 3.1 Pro API 怎么接入?

只想找 Gemini API 入口?先看这里

本页仍专门解释 Gemini 3.1 Pro 的接入与价格口径。 它不是所有 Gemini 模型的统一配置表;复制示例前,先确认你所用平台仍提供该模型,且 Key、协议和模型 ID 配套。入口于 2026-09-09 核查,下面价格表保留原核查日期。

接入 Gemini 3.1 Pro API,先确认 Key、端点和模型 ID 属于同一平台。 Google 官方模型代码是 gemini-3.1-pro-preview;通过聚合服务接入时,ID 和可用功能以该服务的目录为准。不要混用 Google Key 与第三方端点。

先选接入方式

方式Key 从哪里获取要检查什么
Google 官方 APIGoogle AI Studio账号和区域可用性、项目计费、模型权限
OfoxAI 等服务商所选服务的控制台模型 ID、价格、协议、账户限额

国内使用先核对 Google 支持区域 与实际账号条件。网页能打开不代表项目拥有模型访问权限;第三方服务的 Key 也不能用于 Google 官方端点。

本文用 OfoxAI 的 OpenAI 兼容接口演示。先在 模型目录 和控制台确认模型对你的账户可用,再创建 API Key。

用 Python 发起第一次调用

安装 SDK:

python -m pip install openai

把 Key 存入本地环境变量 OFOXAI_API_KEYOFOXAI_MODEL 填控制台确认的模型 ID,例如目录中的 google/gemini-3.1-pro-preview

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["OFOXAI_API_KEY"],
    base_url="https://api.ofox.run/v1",
    timeout=60.0,
)
response = client.chat.completions.create(
    model=os.environ["OFOXAI_MODEL"],
    messages=[{"role": "user", "content": "解释二分查找的时间复杂度"}],
)
print(response.choices[0].message.content)
print(response.usage)

先确认返回文本,再接入业务。这个示例验证文本调用;视频、文件、搜索和工具调用是否透传,需要分别核对服务商的接口说明,不能从文本调用成功推断所有原生功能都支持。

Gemini 3.1 Pro API 多少钱

下表是 Google 官方标准调用价格,核对于 2026-09-07,单位为美元/百万 token。它不是 OfoxAI 或其他服务商的报价。

单次提示词长度输入输出(含思考 token)
不超过 200K token$2$12
超过 200K token$4$18

来源:Google Gemini API 定价。缓存、搜索等功能另有计费规则;通过服务商调用时,以其控制台单价与实际账单为准。

每天 100 次调用大约花多少

假设每次输入 2,000 token、计费输出共 500 token,使用上表短提示词标准价格,且没有其他费用:

每次 = 2,000 / 1,000,000 × $2 + 500 / 1,000,000 × $12
     = $0.004 + $0.006 = $0.01
每天 100 次 = $1.00
30 天 = $30.00

计费输出包含思考 token,不能只数最终显示的答案。实际成本还取决于失败重试、输入长度和所用服务的计费方式,应以返回用量和账单核对。

哪些任务适合尝试

Google 模型文档 列出的输入包括文本、图片、视频、音频和 PDF,输入上限为 1,048,576 token、输出上限为 65,536 token。

可以用它评估长文档检索、多模态分析和复杂工具流程。大上下文不等于可以无损处理任意规模代码仓库;先计算实际 token,并用已知答案检查遗漏。服务商接口是否支持对应输入格式,也需要单独确认。

选型时使用同一组业务样本比较正确率、延迟和每次任务费用。不要把不同测试条件下的榜单分数直接当作实际项目的胜率。

常见报错怎么查

报错排查方向
401Key 是否属于当前平台,环境变量是否加载
403 / PERMISSION_DENIED项目权限、账号或区域条件,以及模型访问授权
模型不存在或不可用从当前目录复制完整 ID,确认模型状态
429 / RESOURCE_EXHAUSTED配额、速率、计费或上游限制,结合错误正文判断
输入过长检查输入 token、端点实际限制,再缩短或分块

不要把 403 一律归为模型名拼错,也不要给所有账户套用固定 RPM。429 的等待与重试方法见 429 Too Many Requests 怎么解决,其他错误见 API 报错速查

常见问题

Gemini 3.1 Pro API 的模型 ID 是什么?
Google 官方模型代码是 gemini-3.1-pro-preview。聚合服务可能带 google/ 前缀,应从所用平台当前目录复制,不要混用 Key 与端点。
Gemini 3.1 Pro API 多少钱?
Google 标准调用在提示词不超过 200K token 时,输入每百万 token 2 美元、输出 12 美元;超过 200K 时为 4 美元和 18 美元。输出包含思考 token,服务商报价需另查。
通过兼容接口能使用所有 Gemini 功能吗?
不能仅凭文本调用成功判断。视频、文件、搜索和工具调用等功能需要逐项核对所用服务商的支持情况。