GPT-6 Astra API 怎么收费?输入、输出和缓存费用怎么算?

GPT-6 Astra API 标准输入每百万 token $10、输出 $50。用普通请求、缓存命中与长上下文三个算例核算预算,分清 Plus、Pro 订阅和 Ofox API 接入。

GPT-6 Astra API 价格与单次任务成本

GPT-6 Astra API 标准输入价为每百万 token $10,输出价为 $50;ChatGPT Plus、Pro 的订阅月费不等于 API 调用余额。 算一项任务的预算,需要同时确认普通输入、缓存、输出和服务模式。本文面向准备接入 API 的开发者,用可复算的账单示例说明价格,再区分官方直连和 Ofox 接入。

最后核对:2026 年 9 月 16 日。美元计价;下方算例是预算演算,没有为本文执行付费生成。

GPT-6 Astra API 的标准价、缓存价分别是多少?

先按 token 类别查费率,再检查是否触发长上下文定价。 OpenAI 模型卡列出的基础费率如下,单位均为美元/百万 token:

计费项目标准费率预算时的含义
普通输入$10.00未按缓存类别结算的输入
缓存读取$1.00实际命中的缓存输入
缓存写入$12.50实际按缓存写入结算的部分
输出$50.00以响应和账单记录的输出用量为准

同一批输入不能既全额算普通输入,又重复计入缓存读取。复用长前缀时,先确认缓存是否实际命中;“第二次发同样的问题”不能直接当成全部输入享受缓存价。

官方模型卡还列明:输入超过 272K token 时,整条请求的输入和缓存费率乘 2,输出费率乘 1.5。Fast 按适用费率乘 2;Batch、Flex 为 Standard 的 50%。这些是 OpenAI API 规则,第三方是否提供相同模式、如何结算,要单独核对。不要把 API 的 Fast 倍率直接套到 Codex credits。

模型卡给出的上下文窗口是 1,050,000 token,最大输出为 128,000 token。窗口容量与价格门槛是两件事:请求装得下,不代表仍按短上下文基础价结算。

一次调用实际多少钱?三个预算算例

把 token 数乘对应单价,再除以一百万。 以下算例均假设只计算文本 token,不含搜索等工具、额外请求、税费或服务商附加费用。

文本费用 =(普通输入 × 普通输入单价
         + 缓存读取 × 缓存读取单价
         + 缓存写入 × 缓存写入单价
         + 输出 × 输出单价)÷ 1,000,000
预算场景假设用量计算合计
普通请求10,000 普通输入,2,000 输出0.10 + 0.10$0.20
缓存命中2,000 普通输入,8,000 缓存读取,2,000 输出0.02 + 0.008 + 0.10$0.128
长上下文300,000 普通输入,2,000 输出,无缓存300,000 × 20/百万 + 2,000 × 75/百万$6.15

缓存算例只计算当前请求,首次准备缓存的成本没有包含在 $0.128 内。长上下文算例使用整条请求的加价费率,不能算成前 272K 仍按 $10、只对后 28K 加价。

按第一个假设,1,000 次请求的文本预算是 $200。若一个用户任务需要三次这样的请求,则预算变成每任务 $0.60;这是请求次数带来的差额,不是单价改变。上线前应记录每次请求的模型、服务模式、用量和最终费用,把重试也计入任务成本。

把第一次缓存写入也算进任务账单

只看一次缓存命中请求,会漏掉整个会话的其他费用。下面这个三次请求的示例任务,合计为 $0.50。 假设使用标准费率、未触发长上下文定价,且各次用量恰好如下。这是预算演算,不是缓存命中实测,也不保证实际请求会命中缓存。

请求普通输入缓存写入缓存读取输出费用
第一次2,00020,00001,000$0.32
追问 12,000020,0001,000$0.09
追问 22,000020,0001,000$0.09

第一次费用为 (2,000 × $10 + 20,000 × $12.50 + 1,000 × $50) / 1,000,000 = $0.32;每次追问为 (2,000 × $10 + 20,000 × $1 + 1,000 × $50) / 1,000,000 = $0.09。表中各输入类别互不重叠,不能再把缓存 token 按普通输入重复收费。同样的 token 量如果完全不使用缓存,三次请求为 3 × (22,000 × $10 + 1,000 × $50) / 1,000,000 = $0.81

实际用量可能不同,要对照供应商的用量记录和账单核算缓存类别,并另计重试、工具及适用的服务模式费用。此示例不含这些额外项目和税费。客户端接入可参考 Astra 配置与迁移检查

Astra 比 GPT-5.6 Sol 贵多少?

按 9 月 16 日 Ofox 目录的基础标价,Astra 输入为 Sol 的 2 倍,输出约为 1.67 倍。 不是整张账单固定翻倍。以下比较来自同一次公开模型目录查询:

Ofox 模型普通输入/百万输出/百万缓存读取/百万
openai/gpt-5.6-sol$5.00$30.00$0.50
openai/gpt-6-astra$10.00$50.00$1.00

对上面的 10,000 输入、2,000 输出假设,Sol 是 $0.11,Astra 是 $0.20,比例约 1.82。真实任务若有不同输出长度或请求次数,比例还会变化。能力选择可接着看Astra 与 GPT-5.6 Sol 对比;预算应使用自己的任务样本,不把排行榜单任务成本当成固定报价。

Plus、Pro 订阅和 API 费用怎么分?

先判断自己使用的是 Chat、Work/Codex,还是 API key。 官方使用说明将登录方式与计费路径分开:ChatGPT 登录使用套餐额度,自带 API key 使用 API 计费。

使用方式应查看哪里
ChatGPT 里的 Chat当前套餐的模型权限与 Chat 限额
用 ChatGPT 登录 Work/CodexWork/Codex 的 Usage 页面
OpenAI API keyOpenAI API 项目的用量和账单
Ofox API keyOfox 账户、模型目录和调用账单

Plus 的 Astra 开放范围不能笼统写成“所有 ChatGPT 入口都有”:官方将 Plus 的 Work/Codex 与符合条件套餐的 Chat 中 GPT-6 Pro 分别说明。看不到模型时,按Plus 看不到 Astra 的入口排查确认权限;能选模型却提示额度用尽,则看GPT-6 Pro 与 Codex 额度、重置区别

OpenAI 直连与 Ofox 分别怎么接入?

保持 key、请求地址和模型 ID 配套。 Ofox Astra 模型页和 9 月 16 日目录列出了 openai/gpt-6-astra,支持 /v1/responses/v1/chat/completions。目录基础价格与上表一致;目录可见不代表某个账户的每次请求都一定成功。

接入方式Responses 请求地址模型 ID
OpenAI 直连https://api.openai.com/v1/responsesgpt-6-astra
Ofoxhttps://api.ofox.run/v1/responsesopenai/gpt-6-astra

下面是 Ofox 的最小请求示例。先设置自己的 OFOX_API_KEY实际执行会产生调用费用。示例不承诺默认输出长度或固定单次价格。

curl https://api.ofox.run/v1/responses \
  -H "Authorization: Bearer $OFOX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-astra",
    "input": "用三个要点解释代码审查应检查什么。"
  }'

如果用于编码工具,接着阅读Astra 编码 Agent 配置。正式放量前,用一个小任务核对返回的 usage 和账户账单,再逐步增加输入长度、输出要求与并发量,建立自己业务的成本基线。

常见问题

GPT-6 Astra API 多少钱?
OpenAI 标准模式每百万普通输入 token 为 10 美元、缓存读取为 1 美元、缓存写入为 12.50 美元、输出为 50 美元。长上下文和 Fast 等模式要另按适用费率计算。
买 ChatGPT Plus 或 Pro 会送 GPT-6 API 额度吗?
ChatGPT 订阅额度与 API 计费分开。用 ChatGPT 登录 Work 或 Codex,与使用自己的 API key,是两种计费路径,不能把订阅月费直接折算成 API 余额。
一次 1 万输入、2000 输出的 Astra 请求多少钱?
假设标准模式、没有缓存和工具费用,输入为 0.10 美元、输出为 0.10 美元,合计 0.20 美元。这是按假设 token 数计算的示例,不是实测账单。
超过 272K 输入 token 后怎么收费?
官方模型卡说明:输入超过 272K token 时,整条请求的输入与缓存费率为基础价的两倍,输出费率为 1.5 倍,不是只对超出的部分加价。
Ofox 调用 Astra 应该填哪个模型 ID?
Ofox 目录中的模型 ID 是 openai/gpt-6-astra;OpenAI 直连使用 gpt-6-astra。API key、请求地址和模型 ID 应属于同一服务商,实际可用性与费用以该服务商账户为准。