GPT-6 Astra API 怎么收费?输入、输出和缓存费用怎么算?
GPT-6 Astra API 标准输入每百万 token $10、输出 $50。用普通请求、缓存命中与长上下文三个算例核算预算,分清 Plus、Pro 订阅和 Ofox API 接入。
GPT-6 Astra API 标准输入价为每百万 token $10,输出价为 $50;ChatGPT Plus、Pro 的订阅月费不等于 API 调用余额。 算一项任务的预算,需要同时确认普通输入、缓存、输出和服务模式。本文面向准备接入 API 的开发者,用可复算的账单示例说明价格,再区分官方直连和 Ofox 接入。
最后核对:2026 年 9 月 16 日。美元计价;下方算例是预算演算,没有为本文执行付费生成。
GPT-6 Astra API 的标准价、缓存价分别是多少?
先按 token 类别查费率,再检查是否触发长上下文定价。 OpenAI 模型卡列出的基础费率如下,单位均为美元/百万 token:
| 计费项目 | 标准费率 | 预算时的含义 |
|---|---|---|
| 普通输入 | $10.00 | 未按缓存类别结算的输入 |
| 缓存读取 | $1.00 | 实际命中的缓存输入 |
| 缓存写入 | $12.50 | 实际按缓存写入结算的部分 |
| 输出 | $50.00 | 以响应和账单记录的输出用量为准 |
同一批输入不能既全额算普通输入,又重复计入缓存读取。复用长前缀时,先确认缓存是否实际命中;“第二次发同样的问题”不能直接当成全部输入享受缓存价。
官方模型卡还列明:输入超过 272K token 时,整条请求的输入和缓存费率乘 2,输出费率乘 1.5。Fast 按适用费率乘 2;Batch、Flex 为 Standard 的 50%。这些是 OpenAI API 规则,第三方是否提供相同模式、如何结算,要单独核对。不要把 API 的 Fast 倍率直接套到 Codex credits。
模型卡给出的上下文窗口是 1,050,000 token,最大输出为 128,000 token。窗口容量与价格门槛是两件事:请求装得下,不代表仍按短上下文基础价结算。
一次调用实际多少钱?三个预算算例
把 token 数乘对应单价,再除以一百万。 以下算例均假设只计算文本 token,不含搜索等工具、额外请求、税费或服务商附加费用。
文本费用 =(普通输入 × 普通输入单价
+ 缓存读取 × 缓存读取单价
+ 缓存写入 × 缓存写入单价
+ 输出 × 输出单价)÷ 1,000,000
| 预算场景 | 假设用量 | 计算 | 合计 |
|---|---|---|---|
| 普通请求 | 10,000 普通输入,2,000 输出 | 0.10 + 0.10 | $0.20 |
| 缓存命中 | 2,000 普通输入,8,000 缓存读取,2,000 输出 | 0.02 + 0.008 + 0.10 | $0.128 |
| 长上下文 | 300,000 普通输入,2,000 输出,无缓存 | 300,000 × 20/百万 + 2,000 × 75/百万 | $6.15 |
缓存算例只计算当前请求,首次准备缓存的成本没有包含在 $0.128 内。长上下文算例使用整条请求的加价费率,不能算成前 272K 仍按 $10、只对后 28K 加价。
按第一个假设,1,000 次请求的文本预算是 $200。若一个用户任务需要三次这样的请求,则预算变成每任务 $0.60;这是请求次数带来的差额,不是单价改变。上线前应记录每次请求的模型、服务模式、用量和最终费用,把重试也计入任务成本。
把第一次缓存写入也算进任务账单
只看一次缓存命中请求,会漏掉整个会话的其他费用。下面这个三次请求的示例任务,合计为 $0.50。 假设使用标准费率、未触发长上下文定价,且各次用量恰好如下。这是预算演算,不是缓存命中实测,也不保证实际请求会命中缓存。
| 请求 | 普通输入 | 缓存写入 | 缓存读取 | 输出 | 费用 |
|---|---|---|---|---|---|
| 第一次 | 2,000 | 20,000 | 0 | 1,000 | $0.32 |
| 追问 1 | 2,000 | 0 | 20,000 | 1,000 | $0.09 |
| 追问 2 | 2,000 | 0 | 20,000 | 1,000 | $0.09 |
第一次费用为 (2,000 × $10 + 20,000 × $12.50 + 1,000 × $50) / 1,000,000 = $0.32;每次追问为 (2,000 × $10 + 20,000 × $1 + 1,000 × $50) / 1,000,000 = $0.09。表中各输入类别互不重叠,不能再把缓存 token 按普通输入重复收费。同样的 token 量如果完全不使用缓存,三次请求为 3 × (22,000 × $10 + 1,000 × $50) / 1,000,000 = $0.81。
实际用量可能不同,要对照供应商的用量记录和账单核算缓存类别,并另计重试、工具及适用的服务模式费用。此示例不含这些额外项目和税费。客户端接入可参考 Astra 配置与迁移检查。
Astra 比 GPT-5.6 Sol 贵多少?
按 9 月 16 日 Ofox 目录的基础标价,Astra 输入为 Sol 的 2 倍,输出约为 1.67 倍。 不是整张账单固定翻倍。以下比较来自同一次公开模型目录查询:
| Ofox 模型 | 普通输入/百万 | 输出/百万 | 缓存读取/百万 |
|---|---|---|---|
openai/gpt-5.6-sol | $5.00 | $30.00 | $0.50 |
openai/gpt-6-astra | $10.00 | $50.00 | $1.00 |
对上面的 10,000 输入、2,000 输出假设,Sol 是 $0.11,Astra 是 $0.20,比例约 1.82。真实任务若有不同输出长度或请求次数,比例还会变化。能力选择可接着看Astra 与 GPT-5.6 Sol 对比;预算应使用自己的任务样本,不把排行榜单任务成本当成固定报价。
Plus、Pro 订阅和 API 费用怎么分?
先判断自己使用的是 Chat、Work/Codex,还是 API key。 官方使用说明将登录方式与计费路径分开:ChatGPT 登录使用套餐额度,自带 API key 使用 API 计费。
| 使用方式 | 应查看哪里 |
|---|---|
| ChatGPT 里的 Chat | 当前套餐的模型权限与 Chat 限额 |
| 用 ChatGPT 登录 Work/Codex | Work/Codex 的 Usage 页面 |
| OpenAI API key | OpenAI API 项目的用量和账单 |
| Ofox API key | Ofox 账户、模型目录和调用账单 |
Plus 的 Astra 开放范围不能笼统写成“所有 ChatGPT 入口都有”:官方将 Plus 的 Work/Codex 与符合条件套餐的 Chat 中 GPT-6 Pro 分别说明。看不到模型时,按Plus 看不到 Astra 的入口排查确认权限;能选模型却提示额度用尽,则看GPT-6 Pro 与 Codex 额度、重置区别。
OpenAI 直连与 Ofox 分别怎么接入?
保持 key、请求地址和模型 ID 配套。 Ofox Astra 模型页和 9 月 16 日目录列出了 openai/gpt-6-astra,支持 /v1/responses 与 /v1/chat/completions。目录基础价格与上表一致;目录可见不代表某个账户的每次请求都一定成功。
| 接入方式 | Responses 请求地址 | 模型 ID |
|---|---|---|
| OpenAI 直连 | https://api.openai.com/v1/responses | gpt-6-astra |
| Ofox | https://api.ofox.run/v1/responses | openai/gpt-6-astra |
下面是 Ofox 的最小请求示例。先设置自己的 OFOX_API_KEY;实际执行会产生调用费用。示例不承诺默认输出长度或固定单次价格。
curl https://api.ofox.run/v1/responses \
-H "Authorization: Bearer $OFOX_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"input": "用三个要点解释代码审查应检查什么。"
}'
如果用于编码工具,接着阅读Astra 编码 Agent 配置。正式放量前,用一个小任务核对返回的 usage 和账户账单,再逐步增加输入长度、输出要求与并发量,建立自己业务的成本基线。
常见问题
- GPT-6 Astra API 多少钱?
- OpenAI 标准模式每百万普通输入 token 为 10 美元、缓存读取为 1 美元、缓存写入为 12.50 美元、输出为 50 美元。长上下文和 Fast 等模式要另按适用费率计算。
- 买 ChatGPT Plus 或 Pro 会送 GPT-6 API 额度吗?
- ChatGPT 订阅额度与 API 计费分开。用 ChatGPT 登录 Work 或 Codex,与使用自己的 API key,是两种计费路径,不能把订阅月费直接折算成 API 余额。
- 一次 1 万输入、2000 输出的 Astra 请求多少钱?
- 假设标准模式、没有缓存和工具费用,输入为 0.10 美元、输出为 0.10 美元,合计 0.20 美元。这是按假设 token 数计算的示例,不是实测账单。
- 超过 272K 输入 token 后怎么收费?
- 官方模型卡说明:输入超过 272K token 时,整条请求的输入与缓存费率为基础价的两倍,输出费率为 1.5 倍,不是只对超出的部分加价。
- Ofox 调用 Astra 应该填哪个模型 ID?
- Ofox 目录中的模型 ID 是 openai/gpt-6-astra;OpenAI 直连使用 gpt-6-astra。API key、请求地址和模型 ID 应属于同一服务商,实际可用性与费用以该服务商账户为准。


