GPT-6 Astra 标准 API 档的价格是每百万输入 token 10 美元、每百万输出 token 50 美元,缓存命中 1 美元、缓存写入 12.50 美元——以上数字全部于 2026 年 9 月 22 日在 OpenAI 官方页面核对。但这是费率卡,不是账单:同一张卡上,Artificial Analysis 测得同一个基准任务在 low 推理强度下花 0.82 美元、在 max 下花 3.26 美元——一个价格都没动,成本先摆了约 4 倍。
这两个数字之间的落差就是本文存在的理由。Astra 发布时有位 Reddit 开发者说得很直接:"GPT-5.6 Sol:输入 $4/M、输出 $20/M。GPT-6 Astra:输入 $10/M、输出 $50/M。输入输出双双 2.5 倍涨价。"(r/codex 原帖,456 赞)。算术没错,但"贵还是便宜"的结论不能靠算术得出——推理强度、服务档位、上下文长度和缓存命中率,每一项对账单的影响都超过换模型本身。文章后段会介绍 Tabbit Browser 作为算完账之后对比模型路由的一个实践入口;先看数字。
要点速览
标准费率:每百万 token 输入 10 美元、缓存命中 1 美元、缓存写入 12.50 美元、输出 50 美元;输入超过 272K 后整个请求改按 20/2/25/75 美元计。
同一张卡能差 4 倍。Batch 和 Flex 全线五折,Fast 模式全线两倍;Artificial Analysis 在相同 token 价格下测得单个任务从 0.82 美元(low)到 3.26 美元(max)。
2.5 倍溢价的基准是促销价。Sol 的 4/20 美元被官方标注为促销价、"至少延续到 2026 年 11 月 21 日";上一代 GPT-5.5 的输入价是 5 美元。
订阅是另一套经济系统。ChatGPT Plus 月费 20 美元含有限 Astra;Pro 显示 100 美元起。社区测得 Astra 在订阅下的有效成本约为 API 价的 1.9 倍,缓存保留约 30 分钟。
按任务形状做预算,别按 token 单价。短问答由输出主导;缓存命中的 agent 循环由缓存读取主导;超过 272K 的一切都为长上下文溢价买单。
GPT-6 Astra 定价速览
完整标准费率卡,2026 年 9 月 22 日取自 OpenAI API 定价页。GPT-6 Astra 总览讲它是什么,这张表只讲钱。
| 模型 | 输入 / 百万 | 缓存命中 / 百万 | 缓存写入 / 百万 | 输出 / 百万 |
|---|---|---|---|---|
| gpt-6-astra | $10.00 | $1.00 | $12.50 | $50.00 |
| gpt-5.6-sol | $4.00 | $0.40 | $5.00 | $20.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 |

这张表里真正决定账单的是三件事,没有一件是标题里的 10 美元:
输出是输入的 5 倍价。Astra 是推理模型,思考过程就是可计费的输出 token。一个不长的提示词配上很长的思维链,就是一张穿着输入外衣的输出账单。
缓存写入比输入还贵。12.50 美元是非缓存价的 1.25 倍——定价页明文写了 1.25x 规则。只有前缀真的被复用时,缓存才划算。
272K 断崖作用于整个请求。输入一过 272,000 token,整单请求——不只是超出部分——按输入 20 美元、缓存 2 美元、写入 25 美元、输出 75 美元计。105 万的上下文窗口不等于 105 万的标准价预算。
那个关键数字:同一张卡,单任务 0.82 到 3.26 美元
如果只记一个数字,记摆幅,不记费率。Artificial Analysis 把 GPT-6 Astra 按推理强度拆成五个条目跟踪,其"每个智能指数任务的成本"(2026 年 9 月 22 日快照)如下:
| 推理强度 | 智能指数 | 每任务成本 | 输出速度 |
|---|---|---|---|
| low | 46 | $0.82 | 55 t/s |
| medium | 50 | $1.54 | 52 t/s |
| high | 51 | $1.73 | 59 t/s |
| xhigh | 52 | $2.31 | 55 t/s |
| max | 53 | $3.26 | 67 t/s |
把最外两列放在一起读:max 档的单任务成本是 low 档的 3.98 倍,换来的智能指数差距是 7 分。同一快照里 low 档的首 token 延迟也最低(2.46 秒)。贵的档位不等于稳妥的档位,它只是在可计费 token 里想得更久的档位。
这对 agent 型工作的影响是双倍的。Astra 最亮的公开成绩——OpenAI 模拟中 OSWorld 2.0 单任务约 40 分钟、Sol 约 75 分钟——描述的恰是 effort 和重试不断复利的工作负载:每轮循环重读上下文,每一步吐出推理 token,一个"能一直跑"的模型也是一个"一直在计费"的模型。Hacker News 有用户报告 15 条消息烧完 ChatGPT 五小时额度(HN 讨论);同样的形状放到 API 计费上,就是深度研究工作流坚持先定验收标准再跑长循环的原因。预算要按完成的任务算,把失败尝试算进去,而不是按第一次尝试算。
把"比 Sol 贵 2.5 倍"翻译成人话

2.5 倍这个数算得没错,但做预算前有两个注意事项要放在它旁边。
注意一:比较基准是促销价。OpenAI 的 Sol 页面注明"GPT-5.6 Sol 的促销价至少延续到 2026 年 11 月 21 日",其快速对比列显示上一代 GPT-5.5 的输入价为 5.00 美元。Sol 的这轮降价发生在 2026 年 7 月 30 日——Sam Altman 当天宣布 Luna 降 80%(至 0.20/1.20 美元)、Terra 降 20%(至 2/12 美元)、Sol 获得按 2 倍价格换最高 2.5 倍速度的 Fast 模式(@sama)。如果 Sol 促销到期,"2.5 倍溢价"会自己缩小,而 Astra 一分没降。GPT-5.6 Sol 长上下文分析单独跟踪这个家族。
注意二:单任务成本可能收敛。上面的原帖是对费率卡的价格冲击,而 Artificial Analysis 测得 low 档单任务 0.82 美元,说明账单可以落到标价下方很远;当能力省下重试时方向完全反转:Sol 失败两次、Astra 一次完成的任务,即使按 2.5 倍费率也是 Astra 更便宜。你的任务属于哪种,是经验问题——用下面的算例回答,费率卡回答不了。
标题之外的计费线项
真正决定多数账单的是四条线,而发布报道只提了第一条。
Batch 和 Flex:五折杠杆。两者都按标准价的一半计费——输入 5 美元、缓存 0.50 美元、写入 6.25 美元、输出 25 美元。Batch 面向可以等几小时的工作(API 暴露 v1/batch,队列限额从 Tier 1 的 150 万 token 到 Tier 5 的 150 亿);Flex 是另一种低价容量模式,可用性取舍不同。评估跑批、离线富集和一切非用户面对的工作,这一个开关省下的钱超过任何提示词优化。折扣不叠加:一次只选一个模式。
Fast 模式:两倍加速器。按适用价率的两倍计费——标准档 20/100 美元,注意"适用"二字:Batch 任务开 Fast 是在 Batch 价上翻倍,不是回到标准价再翻。Priority processing 已于 2026 年 7 月 30 日更名为 Fast mode,service_tier: "priority" 和 "fast" 都还能用,老代码要留意。
区域处理:加 10%。数据驻留端点对 2026 年 3 月 5 日之后发布且支持数据驻留的模型加收 10%——Astra 按发布日期符合条件。合规驱动的区域要为每一行多付一成。
272K 断崖与缓时钟。输入超过 272K 后,长上下文一行(20/2/25/75 美元)作用于整单请求——没有"只算超出部分"的算法。而本该给重复读取降本的缓存,社区报告它的保留时间很短:Codex 用户观察到 Astra 约 30 分钟,而 Sol 和更早模型是 24 小时。

OpenAI 没有公布 TTL 对照表,所以把 30 分钟当作有两个独立来源的行为报告(原帖、评论),不是承诺。如果你的循环在两步之间睡得比这更久,1 美元的缓存命中会悄悄变回 10 美元的冷读加 12.50 美元的写入。
工具调用在这一切之外:OpenAI 说明 web search 等工具型能力按每次调用收费,一个搜索 40 次的 agent 身上还挂着第二只计费器。
家族阶梯:哪一行才是你的
阶梯里反直觉的一行是 Luna:比 Astra 的输入便宜 50 倍,而且它是真实存在的产品行。官方模型目录把 Luna 描述为面向成本敏感、大批量工作负载,OpenAI 自己的选型建议也是"除非工作难到需要旗舰,否则默认 Terra 或 Luna"。便宜的那一行不是玩具,它是路由目标——每一路由到 Luna 而不是 Astra 的 token,输入侧省 50 倍。
第二个反直觉发现来自家族之外。Astra 和 Anthropic 的 Fable 5.1 挂着完全相同的 10/50 美元——而真实成本朝相反方向走:

发帖人的算法:Astra 完成单个任务更省 token(其长单任务上"token 成本不到 Fable 5.1 的一半"),而 Fable 的缓存读取每百万 0.25 美元,比 Astra 的 1.00 美元便宜 4 倍——所以"大缓存上下文上的高频调用"偏 Fable,"长单任务"偏 Astra。一位评论者在两个模型上各跑了一周文档检索管线,85% 缓存命中率下 Fable 成本约为 Astra 的一半,"这个任务上表现基本一样":

可迁移的结论不需要你选哪家的实验室:费率卡只是成本函数里最小的输入。任务长度、缓存命中率、输出体量这些流量形状才是主导。社区测评合集保留了更多这类带条件的报告。
费率卡不覆盖的东西
订阅不是 API 信用。ChatGPT 套餐给的是用量,按额度和时间窗计价——下一节会说明这些额度自成一套经济系统。永远不要拿 20 美元的套餐除以 token 单价。
失败的尝试照样计费。发布周的一份报告记录了一次 33 分钟的 Codex 运行:成功请求之前,两次超时的尝试已经消耗了额度(r/ChatGPT)。重试是成本线,不是免费的。
API 免费档关闭。速率限制表把 Astra 标为 Free 档不可用;付费从 Tier 1 起步,每分钟 500 次请求、50 万 token。
税费、工具和供应商加价另算。OpenRouter 市场页显示 Azure 和 OpenAI 都按 10/50/1 美元挂 Astra,但延迟画像不同(今日快照中首 token P50 分别为 6.92 秒和 4.80 秒)——同价不同路由。Amazon Bedrock 商业区域官方声明与 OpenAI 直连同价。
套餐可得性:API 分层与 ChatGPT 套餐
| API 档位 | RPM | TPM | Batch 队列限额 |
|---|---|---|---|
| Free | 不支持 | — | — |
| Tier 1 | 500 | 500,000 | 150 万 token |
| Tier 2 | 5,000 | 1,000,000 | 300 万 token |
| Tier 3 | 5,000 | 2,000,000 | 1 亿 token |
| Tier 4 | 10,000 | 4,000,000 | 2 亿 token |
| Tier 5 | 15,000 | 40,000,000 | 150 亿 token |
来源:OpenAI gpt-6-astra 模型页,2026 年 9 月 22 日核对。档位随消费提升,发布周的封顶不是永久的。
消费端,ChatGPT 定价页当前展示四档:Free 0 美元(无限 GPT-5.6 Luna 文本聊天——无 Astra)、Go 每月 8 美元、Plus 每月 20 美元(含"GPT-6 Astra 与 GPT-5.6 的高级推理模型",比较矩阵中 Astra 标为有限)、Pro 显示"100 美元/月起"、5 倍用量、"由 GPT-6 Astra 提供支持的专业推理"。社区讨论仍提到 200 美元的 Pro 档,YouTube 视频简介也同时列出"100 和 200 美元"两档——以实时页面为准,当前显示的是"起价"口径。
订阅经济学值得单独贴一张警示标签,因为三项独立的社区测量指向同一方向:

第一,额度数学:两个 Pro 账号上,周度 API 等价额度从 Sol 的 2500+ 美元降到 Astra 的约 1200 美元——且这个数字已经按 Astra 更高的单价折算——"同样的订阅费只换来大约四分之一的可比用量"。第二,有效价率:一位 Plus 订阅者反推出在同一额度下 Astra 相对 Luna 的有效成本约为 API 价的 1.90 倍(实测用量 134.42 对 70.59 美元)。第三,燃烧体验:


"Astra 确实好用,但要做点有意义的事,200 美元一个月的订阅给的 token 根本不够"——这是一位游戏开发者的总结,能力和抱怨在同一句话里。如果你只是偶尔、有监督地用 Astra,Plus 可能够;如果它是每日流水线的引擎,带 Batch 的 API 才是可预测的路线,订阅是溢价交互路线。
两组算例,假设全部摆明
使用标准短上下文档率,不含重试、工具和税费。是算术演示,不是预测。
一个短问题,一段长思考。10,000 输入 token、2,000 输出 token:
(10,000 × $10 + 2,000 × $50) / 1,000,000 = $0.20一次跨过断崖的冷启动 agent 循环。300,000 输入 token——注意已经过了 272K,长上下文档率作用于全部——8,000 输出 token:
(300,000 × $20 + 8,000 × $75) / 1,000,000 = $6.60同样的循环控制在 272K 以内(比如 260,000 token)是 4.00 美元。跨过那条线,这个形状多付 65%。再看暖版本:同样 300,000 token 上下文、90% 命中、每小时写一次缓存、8,000 输出:
(270,000 × $2 + 30,000 × $20 + 8,000 × $75) / 1,000,000 = $1.68 + 写入本地计算
估算 GPT-6 Astra API token 成本
使用 2026-09-22 核对的官方美元费率。输入值仅在浏览器本地处理。
缓存写入按输入价的 1.25 倍计费。该估算不含重试、工具、税费、10% 区域加价和代理商加价。输入超过 272K 时自动把所有线项切换为长上下文档率。 核对最新费率
计算器完全在本页运行——不向任何地方发送数据。它会自动应用 272K 长上下文切换、按所选服务档计价、把缓存写入与命中分开。它刻意不建模的东西:重试、工具调用费、区域 10% 和缓时钟——这些留在你的利润率里。承诺预算前请重新核对官方费率卡;本文数字截至 2026 年 9 月 22 日。
一个实践入口:在 Tabbit 里跑对比
预算之后是无聊的部分:真正跑 Astra 型工作,需要一个页面、文件和模型调用待在同一个地方的环境。这正是 Tabbit Browser 的位置——一个模型选择器、实时页面和本地文件同处一个界面的 AI 浏览器,"先用 Astra 的 medium 档试,不行退回 Luna"是一次选择,而不是一个编排项目。

边界要说清楚:Tabbit 是客户端,不是 OpenAI 的计费层。模型可得性取决于你的账户和版本,浏览器里的任何操作都不改变 OpenAI 收什么钱——上面的费率卡在哪儿跑 Astra 都适用。浏览器改变的是搭建成本:GPT-6 Astra 资源页和它的提示词合集描述了可以对着选择器直接跑的可复现任务,这是弄清你的负载到底需要哪个强度档的最便宜方式——不用写一行编排代码。
如果工作重点是浏览器级自动化而不是对话,agentic 浏览器总览、什么是 agentic 浏览器和浏览器自动化指南覆盖那条工作流;AI 浏览器指南是一般性起点。
GPT-6 Astra 定价决策表
| 你的工作负载 | 成本驱动 | 最佳起步路径 | 当心什么 |
|---|---|---|---|
| 交互式聊天、短回答 | 输出 token | API 低/中强度,或 Plus | $50/M 输出主导,是输入价的 5 倍 |
| 过夜评估或富集 | 体量 | Batch 五折 | 分档队列限额,结果按小时计 |
| 272K 以内的长 agent 循环 | 缓存读取与写入 | 标准档 + 稳定前缀缓存 | 社区报告约 30 分钟缓存保留 |
| 超过 272K 的上下文 | 断崖 | 重构压到线下,或按 20/75 预算 | 整单重新计价,不是只算超出部分 |
| 延迟敏感的生产流量 | Fast 模式 | 最低够用强度上开 Fast(2x) | 强度选择对成本的影响大于档位 |
| 每日重度消费端使用 | 订阅额度 | Pro(100 美元起)或 API+Batch | 社区报告额度消耗比 Sol 快约 4 倍 |
最终裁决
GPT-6 Astra 按"难活儿的原料"定价,也按这个方式出账单。当任务长程、重工具、人工盯守成本高时买它——然后小心地买:能等的工作全走 Batch,强度从 low 起步直到验收测试说不行,上下文工程化压到 272K 以下,缓存友好的前缀对着 30 分钟的时钟测算。不需要旗舰能力的体量留给 Luna 或 Terra——家族阶梯存在的意义,就是让旗舰成为一个路由决策而不是默认值。
如果 Astra 是你 API 上的日常引擎,按"完成的任务"做预算(含重试和工具费),并每月复查官方定价页——Sol 的促销基准挂着 11 月 21 日的日期,整条阶梯都可能移动。专门的替代品对比还在准备中;在它上线前,模型资源页、总览和上文引用的社区记录就是溯源路径。
来源
OpenAI API 定价与gpt-6-astra 模型页——费率、档位规则、速率限制,2026 年 9 月 22 日核对
ChatGPT 定价——Free/Go/Plus/Pro 展示口径,2026 年 9 月 22 日核对
Sam Altman,2026 年 7 月 30 日——Luna/Terra 降价与 Sol Fast 模式公告
Artificial Analysis GPT-6 Astra 发布页——强度档智能、速度与每任务成本快照,2026 年 9 月 22 日
OpenRouter GPT-6 Astra——供应商费率与延迟快照,2026 年 9 月 22 日
社区记录(截图与条件随文标注):r/codex 1w6hvo9、r/codex 1wciwc1、r/codex 1w8r103、r/LLMDevs 1w9z8nb、r/ChatGPT 1w9nya5、Ask HN
常见问题
GPT-6 Astra 多少钱?
2026 年 9 月 22 日在 OpenAI 官方页面核对的标准 API 费率为:每百万输入 token 10 美元、缓存命中 1 美元、缓存写入 12.50 美元、输出 50 美元。输入超过 272K 的请求整单改按长上下文档率计费(输入 20 美元、缓存 2 美元、写入 25 美元、输出 75 美元)。Batch 和 Flex 按标准价五折计费,Fast 模式按两倍计费,数据驻留区域端点另加 10%。
GPT-6 Astra 有免费额度吗?
API 免费档不支持。OpenAI 对 gpt-6-astra 的速率限制表把 Free 档标为不可用,付费访问从 Tier 1 开始。消费端方面,ChatGPT 免费版提供无限量的 GPT-5.6 Luna 文本聊天但没有 Astra;Plus 含有限的 Astra 访问,Pro 档官方描述为由 GPT-6 Astra 提供支持。
为什么 GPT-6 Astra 比 GPT-5.6 Sol 贵 2.5 倍?
OpenAI 把 Astra 定位为处理推理、编码、computer use 和研究等最难端到端工作的模型,因此按 10/50 美元对 Sol 的 4/20 美元定价。需要注意 Sol 当前费率是促销价,官方标注至少延续到 2026 年 11 月 21 日,比较基线本身可能变化。当 Astra 能以更少的重试完成任务时,每个任务的实际成本会向 Sol 靠拢。
为了用 GPT-6 Astra,ChatGPT Pro 值得买吗?
取决于工作负载。Pro 页面显示月费 100 美元起、5 倍使用额度、Astra 驱动的专业推理;但社区实测报告周度 API 等价额度从 Sol 的约 2500 美元降到 Astra 的约 1200 美元、缓存保留约 30 分钟,重度用户很快烧完额度。如果你的任务是长程 agent 型,建议仔细核算预算,或在延迟允许时走 API 的 Batch 档。
跑 GPT-6 Astra 最省钱的方式是什么?
组合使用几个杠杆:非紧急工作走 Batch 或 Flex(标准价五折);先用 low 或 medium 推理强度,验收测试不通过再升级;把输入控制在 272K 以下避免长上下文档率;缓存稳定前缀,让重复读取按每百万 1 美元而不是 10 美元计费。
GPT-6 Astra 的 API 价格包含工具调用吗?
不包含。公布的 token 费率只覆盖文本输入和输出。OpenAI 说明 web search、computer use 等工具型能力按每次调用另行收费,与 token 定价分开计费,所以重工具的 agent 需要在预算里单独列一条。