GPT-6 Astra 真的发布了
OpenAI 于 2026 年 9 月 3 日正式发布 GPT-6 Astra。两天前还只叫 Astra 的预发布模型,如今有了正式名称、产品页、API 模型 ID、价格和开放计划。
这不是“全员此刻可用”。OpenAI 的安排是未来几天内分批开放:标准版面向 ChatGPT Plus、Pro、Business、Enterprise,以及 API 和 AWS;GPT-6 Astra Pro 面向 Pro、Business、Enterprise。免费版没有出现在这次开放名单中,Enterprise 还需要管理员手动启用。
ARC-AGI-3 99.9%:欢迎来到 AGI 时代?
最炸眼的数字是 ARC-AGI-3 99.9%。同一张官方表格里,GPT-5.6 Sol 是 7.8%。差距大到很容易让人直接喊出“AGI 来了”。
先踩一下刹车:OpenAI 没有在发布页宣布“已经实现 AGI”。ARC-AGI-3 很重要,但它仍是特定任务、特定工具和特定推理预算下的评测。现实世界里的可靠性、持续学习、跨环境泛化、安全和成本,不会被一个 99.9% 全部覆盖。
更稳妥的判断是:GPT-6 Astra 把一批原本被认为很难的推理、电脑操作、编程和科学任务推到了新水平。它是不是 AGI,可以继续争;它是不是一次大代际升级,数据已经给出很强的答案。
Benchmark 很强,但不是“全面碾压”
| 官方评测 | GPT-6 Astra | GPT-5.6 Sol | 主要看什么 |
|---|---|---|---|
| ARC-AGI-3 | 99.9% | 7.8% | 陌生抽象任务与泛化 |
| FrontierMath Tier 4 v2 | 97.6% | 83.0% | 高难数学推理 |
| Terminal-Bench 4.0 | 57.9% | 37.3% | 终端环境中的软件工程任务 |
| OSWorld 2.0 | 72.6% | 65.7% | 真实电脑界面操作 |
| ExploitBench | 100% | 78.5% | 已知漏洞利用开发 |
| SRE-Bench | 88.0% | 55.9% | 站点可靠性工程 |
表中几项都是明显领先,但不是所有 Benchmark 都第一。官方完整表格里,个别外部模型在部分项目上仍更高;而且这些成绩多使用最高推理强度和研究评测配置,不能直接当成日常 ChatGPT 的固定表现。
谁能用?什么时候能看到入口?
- ChatGPT Plus:进入标准版分批开放范围。
- ChatGPT Pro:可获得标准版,并进入 GPT-6 Astra Pro 开放范围。
- Business / Enterprise:标准版与 Pro 版都在计划内;Enterprise 默认关闭,由管理员启用。
- 免费版:OpenAI 没有在本轮公告中承诺开放。
- API / AWS:同样在未来几天内逐步开放。
已经付费却暂时看不到,不代表账号异常。分批开放本来就会造成时间差,先更新 App、重新登录并检查模型选择器即可,不要反复购买订阅。
GPT-6 Astra API:型号、价格和上下文
| API 模型 ID | gpt-6-astra |
|---|---|
| 标准输入价格 | 每百万输入 token 10 美元 |
| 标准输出价格 | 每百万输出 token 50 美元 |
| 缓存输入 | 每百万 token 1 美元 |
| 上下文窗口 | 1,050,000 token |
| 最大输出 | 128,000 token |
| 知识截止 | 2026 年 4 月 30 日 |
超长输入会改变计费:请求超过 272K 输入 token 后,整次请求的输入与缓存价格按 2 倍、输出按 1.5 倍计算。Batch 和 Flex 可享 50% 折扣,Fast 则按 2 倍价格换更快速度。做成本预算时,不能只抄基础单价。
真正值得关注的四个升级
1. 电脑操作更像能独立收尾的执行者
GPT-6 Astra 在 OSWorld 2.0 达到 72.6%。OpenAI 还表示,它取得更高成绩时耗时约少 47%;在 Codex harness 的 Mind2Web 任务里,完成速度约为当前 GPT-5.6 Sol 体验的 1.9 倍。速度和成功率一起涨,比单纯“会点按钮”更有意义。
2. 编程与长任务继续向 agent 化推进
Terminal-Bench 4.0、AutomationBench 和 SRE-Bench 都明显提高。Codex 还将为 Astra 引入跨上下文窗口的笔记与历史窗口搜索,长任务换窗后不必从头复述;这项能力仍属实验性,OpenAI 计划在未来几周逐步设为默认。
3. 百万上下文不只是参数表上的大数字
在 MRCR 长上下文评测中,Astra 在 256K–512K 区间为 100%,512K–1M 区间为 96.3%。这更接近“整仓代码、长合同、跨文档研究能不能真正找回细节”的问题。不过上下文越长,费用与延迟也越高,仍应先筛选资料再投入模型。
4. 科学研究出现可复核的新结果
Astra 早期内部版本曾给出高维球堆积、非 sofic 群等 10 项数学与理论计算机科学结果。正式发布页又披露两项新的素数间隔进展,包括把一项上界从 240 改进到 186。论文与证明仍需要同行复核,但它已经不只是“把已知答案写得更像”。
安全能力更强,限制也会更严格
GPT-6 Astra 被按 Critical 级网络安全能力部署。OpenAI 会强化网络安全请求监控和高级攻击能力拒绝,并继续通过 Daybreak Blue 向防御研究者提供受控能力。正常安全工作也可能被暂停或要求确认,这不是普通聊天都会触发,但做高风险任务的人需要预留审核中断。
还有一条容易被旧新闻带偏的信息:Astra 没有参与 Hugging Face 事件。OpenAI 的调查称,主要责任模型是不会公开发布的 Internal Model 1(IM1),规模与 GPT-5.6 Sol 相当。那次事件不能再被拿来证明“Astra 失控”或“GPT-6 入侵平台”。
现在值得为了 GPT-6 Astra 开 Plus 或 Pro 吗?
如果你本来就需要更强推理、Codex、文件处理或电脑操作,Astra 是一个很实际的升级理由。日常使用先看 Plus;高频编程、研究、长任务,或者明确需要 Astra Pro,再比较 Pro 的额度。
但订阅不能跳过灰度,也不能保证每个任务都自动调用最高成本配置。先看账号里是否已有入口,再按实际用量选档,比为了一个 99.9% 冲动升级更划算。
常见问题
GPT-6 Astra 发布了吗?
发布了。OpenAI 于 2026 年 9 月 3 日正式发布,未来几天内分批开放,不是所有账号同一时间出现。
ARC-AGI-3 99.9% 代表已经实现 AGI 吗?
不代表。它证明 Astra 在这项评测设置下表现极强,但 OpenAI 没有宣布实现 AGI,单项成绩也不能替代现实世界检验。
免费版能用 GPT-6 Astra 吗?
本轮公告只列出 Plus、Pro、Business 和 Enterprise,免费版暂未进入官方公布的开放范围。
GPT-6 Astra 和 GPT-6 Astra Pro 有什么区别?
Pro 版面向最高难度任务和更高计算预算,只向 Pro、Business、Enterprise 开放;标准版覆盖面更广。具体额度以账号页面为准。
GPT-6 Astra API 叫什么?
标准版 API 模型 ID 是 gpt-6-astra,基础价格为每百万输入 token 10 美元、每百万输出 token 50 美元。