GPT-6 Astra API 定价:$10 和 $50,GPT-5.6 Sol 的两倍

GPT-6 Astra 每百万输入 token $10、输出 $50,缓存输入 $1.00,Fast 模式翻倍。单任务实际花多少,以及怎么接入。

GPT-6 Astra API 定价:$10 和 $50,GPT-5.6 Sol 的两倍

GPT-6 Astra 每百万输入 token $10.00、输出 $50.00。输入是 GPT-5.6 Sol 的两倍,输出贵三分之二。 OpenAI 在 2026 年 9 月 3 日发布,模型 ID 是 gpt-6-astra,上下文窗口 1.1M,输出上限 128K,知识截止 2026 年 4 月。

模型 ID:     gpt-6-astra
标准价:      每百万输入 $10.00 / 输出 $50.00
缓存输入:    每百万 $1.00
Fast 模式:   约 $20 / $100,最高 2.5 倍标准速度
上下文:      输入 1.1M / 输出 128K
知识截止:    2026 年 4 月
版本:        Astra、Astra Pro(这一代没有 Sol / Terra / Luna 的拆分)
接入:        OpenAI API、ChatGPT 付费套餐、Amazon Bedrock
网关:        Ofox 上为 openai/gpt-6-astra(2026-09-05 上架)

最后更新于 2026 年 9 月 5 日。GPT-6 Astra 已在 Ofox 目录上架,下面的接入一节已同步。

GPT-6 Astra 到底多少钱

输入 $10、输出 $50,而跟同价位邻居差最多的是缓存读那一行。

每百万 token 费率GPT-6 Astra
输入$10.00
输出$50.00
缓存输入$1.00
Fast 模式输入约 $20.00
Fast 模式输出约 $100.00

Fast 模式是不太常见的一行。OpenAI 的说法是最高 2.5 倍标准速度、两倍标准价格。这是延迟旋钮而不是能力旋钮:同一个模型,答得更早,价格翻倍。这笔交易划不划算,完全取决于是不是有人在等这个响应。

GPT-6 Astra vs GPT-5.6 Sol:价格涨了

这是一次涨价的换代,不是降价。

每百万费率GPT-5.6 SolGPT-6 Astra变化
输入$5.00$10.002.0 倍
输出$30.00$50.001.67 倍
缓存输入$0.50$1.002.0 倍

两边都是 2026 年 9 月 5 日的 Ofox 实时目录。每一行要么翻倍,要么接近翻倍。

这个方向值得停一下,因为它不是近期的常态。Wan 3.0 把上一代的费率砍了一半Gemini 3.8 Flash 相对前代价格持平。Astra 的定价是按上一个档次来的,不是按小版本刷新,所以升不升级这道题只能用产出质量来回答,不能用成本。Astra 与 GPT-5.6 Sol 的对比讲了多花的钱什么时候能挣回来,以及 Sol / Terra / Luna 这套档位名为什么没有延续下来。

单任务实际花多少

按 Artificial Analysis 的测量,max 档每任务 $1.67,high 档 $0.96。

Astra 档位AA 智能指数单任务成本跑完整个指数的花费输出 token
max61$1.67$3,013.3042M
high60$0.96$1,429.2616M

这两行之间的差距就是这个模型上最实际的定价决策。max 写的输出 token 是 high 的 2.6 倍,跑完指数的花费是 2.1 倍,换来一分。在比 AA 那套九项混合更窄的负载上,这一分可能根本不存在。

从 high 起步。 在为 max 付双倍价之前,先量一下它到底改没改变你的产出。推理 token 不管你读不读都按输出价计费,所以 effort 档位本质上是一个附带质量假设的价格乘数。

GPT-6 Astra 排在哪

Artificial Analysis 智能指数 61 分,202 个模型里第 8。 很强,而且明确不是第一。压在它上面的每一个都是 Claude 或 Muse Spark 的变体:

模型指数单任务成本
Claude Fable 5.1(max)66$3.69
Claude Fable 5.1(xhigh)65$2.65
Claude Opus 5(max)63$2.34
Claude Fable 5.1(high)62$1.43
GPT-6 Astra(max)61$1.67
Claude Opus 5(high)61$1.23
Muse Spark 1.3(xhigh)61$0.55

这张表有两种读法,而且都成立:

  • 在 61 分这个水平上,Astra 不是拿到 61 分最便宜的路子。 Muse Spark 1.3 的 xhigh 档同样 61 分,单任务只要 $0.55,大约是 Astra 的三分之一。
  • 在 $10 / $50 这个价位上,Astra 不是最强的那个。 Claude Fable 5.1 单 token 价格完全一样,指数高五分。完整对比讲了各自还赢在哪,包括 OpenAI 自家 benchmark 明确偏向 Astra 的那些负载。

这个 61 值得一直放在视野里,因为它相比 GPT-5.6 Sol 一分没动。我们的完整测评梳理了指数持平配上 2.5 倍涨价意味着什么、为什么那个头条 ARC-AGI-3 分数换个 harness 就变成完全不同的值,以及 OpenAI 自己的 system card 怎么说这个模型的推理变得更难监控。

OpenAI 公布的 benchmark

厂商自己的数字偏智能体,不偏通用:

Benchmark分数
OSWorld 2.0(电脑操作)72.6%
FrontierMath Tier 4 v297.6%
GPQA Diamond96.0%
Terminal-Bench 4.057.9%
ExploitBench100.0%
ExploitGym42.4%
SRE-Bench(单次尝试)88.0%
ARC-AGI-3(adapter harness)99.9%
Humanity’s Last Exam(带工具)57.2%

读数字的时候要把限定一起读:ARC-AGI-3 的 99.9% 是用 adapter harness 测的,Humanity’s Last Exam 的 57.2% 是带工具的。这些都是合法配置,同时它们也不等同于不带限定的那个测试。厂商在厂商选的任务上做的 benchmark 回答的是「这个模型擅长什么」,第三方综合指数回答的是「它跟别人比怎么样」,这是两个不同的问题。

怎么接入 GPT-6 Astra

四条路,其中一条默认是关的。

  • OpenAI API。 模型 ID gpt-6-astra
  • ChatGPT。 Plus、Pro、Business、Enterprise,在 9 月 3 日发布后几天内陆续开放。Pro、Business 和 Enterprise 套餐上还有更高一档的 Astra Pro。
  • Amazon Bedrock。 发布即支持。
  • Enterprise 工作区。 默认关闭,需要管理员按工作区启用。如果你们组织买了 Enterprise 但看不到这个模型,先查这里,而不是以为在排队等灰度。
from openai import OpenAI

client = OpenAI(api_key="YOUR_OPENAI_API_KEY")

r = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[{"role": "user", "content": "Refactor this function to remove the nested loop."}],
)
print(r.usage)

做成本预测之前,先拿自己的 prompt 读一遍 usage。在输出每百万 $50、推理 token 也按这个价计费的前提下,token 数量比价目表更能决定账单。

走 Ofox

GPT-6 Astra 自 2026 年 9 月 5 日起已在 Ofox 目录上架,模型 ID 是 openai/gpt-6-astra,价格与 OpenAI 直连一致,都是 $10.00 / $50.00。

模型输入 / 百万输出 / 百万缓存读AA 指数
openai/gpt-6-astra$10.00$50.00$1.0061(max)
anthropic/claude-fable-5.1$10.00$50.00$0.2566(max)
openai/gpt-5.6-sol$5.00$30.00$0.50

Astra 的缓存写是 $12.50。模型上报的上下文是 1,050,000 token、最大补全 128K,走 /v1/chat/completions/v1/responses,别名是 gpt-6-astragpt-6-astra-2026-09-03

curl -X POST https://api.ofox.ai/v1/chat/completions \
  -H "Authorization: Bearer $OFOX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-astra",
    "messages": [{"role": "user", "content": "..."}],
    "reasoning": {"effort": "high"}
  }'

定下来之前先看缓存那一行。Fable 5.1 的单 token 价格跟 Astra 完全一样,但缓存读只要四分之一,在任何要反复重放长前缀的智能体循环上,这个差距会累积。GPT-5.6 Sol 的输入价仍然是一半。GET https://api.ofox.ai/v1/models 始终是「什么能调」的准绳。

谁该付这每百万 $50

  • 电脑操作与终端自动化,具体依据是 OSWorld 2.0 的 72.6% 和 Terminal-Bench 4.0 的 57.9%。
  • 安全工具链,ExploitBench 100%、SRE-Bench 单次尝试 88%,这两项没有直接对应的第三方复现。
  • 对延迟敏感的交互式产品,能把 Fast 模式的 $20 / $100 算回来。

以及谁不该:任何在通用推理上走量的场景——同一个指数里,$0.55 一个任务就能买到同样的分数。上了规模之后这个成本差不是边角料,而对多数生产负载来说,上一代的逐档拆解仍然是更便宜的起点。

来源

GPT-6 Astra 的 benchmark 是 OpenAI 2026 年 9 月 3 日的发布数字。指数分数与单任务成本读取自 Artificial Analysis,2026 年 9 月 4 日。GPT-6 Astra 与对照模型的 Ofox 费率读取自 2026 年 9 月 5 日的实时 /v1/models 端点。

常见问题

GPT-6 Astra API 多少钱?
标准模式每百万输入 token $10.00、输出 $50.00,缓存输入读取 $1.00。Fast 模式最高 2.5 倍速度、约两倍价格,即输入约 $20、输出约 $100。API 的模型 ID 是 gpt-6-astra。
GPT-6 Astra 比 GPT-5.6 Sol 贵吗?
贵不少。Ofox 上 GPT-5.6 Sol 是输入 $5.00、输出 $30.00。GPT-6 Astra 把输入翻倍到 $10.00,输出提高三分之二到 $50.00。同口径下缓存输入也从 $0.50 涨到 $1.00。
GPT-6 Astra 的上下文窗口有多大?
输入 1.1M token,最大输出 128K token,知识截止 2026 年 4 月。百万级窗口不等于百万级回复,长文档的活在输出侧仍然要切块。
GPT-6 Astra 单个任务要花多少钱?
Artificial Analysis 测到 max 档每任务 $1.67,high 档 $0.96。跑完整个指数 max 花了 $3,013.30,high 是 $1,429.26,因为 max 写了 4200 万输出 token 而 high 只有 1600 万。max 多买到的那一分,代价大约是两倍。
Ofox 上能用 GPT-6 Astra 吗?
能,2026 年 9 月 5 日起以 openai/gpt-6-astra 上架,每百万输入 $10.00、输出 $50.00,缓存读 $1.00、缓存写 $12.50,上下文 1,050,000 token,最大补全 128K。同档位另有两个选择:anthropic/claude-fable-5.1 标价相同但缓存读只要 $0.25,openai/gpt-5.6-sol 是 $5.00 / $30.00。
在哪些地方可以用到 GPT-6 Astra?
OpenAI API 里模型 ID 为 gpt-6-astra;ChatGPT 的 Plus、Pro、Business 和 Enterprise 套餐在 2026 年 9 月 3 日发布后几天内陆续开放;Amazon Bedrock 发布即支持。Enterprise 上默认关闭,需要管理员按工作区启用。