GPT-6 Astra是一款由OpenAI推出的新一代旗舰大模型,主要用于计算机操作、软件工程与科学研究等完整工作流程,支持自主填写表单、更新 CRM 记录、分析科学数据并生成图表,适用于需要 AI 独立交付成果的开发者、科研人员与企业团队。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | 全球最智能、对齐程度最高的旗舰大模型,主打计算机操作 |
| 开发方 | OpenAI |
| 发布时间 | 2026 年 9 月 3 日(当地时间) |
| 训练规模 | 得州 Stargate 基地,首次超过 10 万张 GPU 预训练 |
| 计算机操作 | OSWorld 2.0 得分 72.6%,ScreenSpot-Pro 得分 92.7% |
| 关键基准 | ARC-AGI-3 得分 99.9%,FrontierMath Tier 4 得分 97.6% |
| API 定价 | 输入 10 美元/百万 tokens,输出 50 美元/百万 tokens |
| 开放方式 | 闭源,通过 ChatGPT、OpenAI API 与亚马逊云服务提供 |

GPT-6 Astra 的核心能力
计算机操作:从给建议到直接干活
Astra 可自主填表、更新 CRM、整理日程,也能在线研究并把结论写入邮件或文档;遇软件问题可自主安装排查。在 OSWorld 2.0 测试中得分 72.6%(GPT-5.6 Sol 为 65.7%)。
软件工程:长程任务不再丢上下文
Astra 在 Terminal-Bench 4.0 得分约 58%,高于 GPT-5.6 Sol 的 37.3% 与 Claude Fable 5.1 的 55.8%;内部数据库迁移达 63.9%(Sol 为 42.7%)。关键在上下文机制:旧模型装满会压成摘要、丢细节,Astra 可跨窗口存笔记、完整历史可检索。思路与同周 Gemini 3.8 相近。
科学研究:进入专业软件而非只做文字推演
Astra 在 GPQA Diamond 达 96.0%,FrontierMath Tier 4 达 97.6%(GPT-5.6 Sol 为 83.0% 与 22.4%)。OpenAI 称其已参与部分长期未解数学问题,还能进专业软件检查测序数据、运行模拟。
网络安全与对齐:能力最强,边界也更硬
Astra 是 OpenAI 首个达内部「关键级」网络安全门槛的模型,ExploitBench 得分 100%(Sol 为 78.5%);新漏洞测试集上任意代码执行成功率 39%(Sol 仅 5.5%)。同类产品还有 Claude Mythos 5.1,同样以网络安全特化见长。
能力上去了,越界反而下降。越权测试中 GPT-5.6 Sol 无防护时约 48% 超授权,Astra 为 0%;计算机操作安全不当行为率 2.4%(Sol 为 22.0%)。
GPT-6 Astra 与同类模型的对比
2026 年 9 月首周旗舰密集发布,Meta、Anthropic 与谷歌一周内更新主力,下表选三款旗舰横向比较。
| 对比维度 | GPT-6 Astra | Claude Fable 5.1 | Muse Spark 1.3 | Qwen 3.8-Max |
|---|---|---|---|---|
| 开发方 | OpenAI | Anthropic | Meta 超级智能实验室 | 阿里通义千问 |
| 产品定位 | 最智能、最对齐的旗舰,主打计算机操作 | 通用旗舰,偏编程与科研 | 长周期智能体与编码旗舰 | 旗舰智能体,覆盖编程与科研 |
| 计算机操作 | OSWorld 2.0 得分 72.6% | ScreenSpot-Pro 得分 87.3% | 未公布同口径数据 | 未公布同口径数据 |
| 软件工程 | DeepSWE v1.1 得分 74.1%,Terminal-Bench 4.0 约 58% | DeepSWE v1.1 得分 67.4%,Terminal-Bench 4.0 得分 55.8% | DeepSWE v1.1 得分 75.4%,Terminal-Bench 2.1 得分 88.8 分 | SWE-bench Pro 得分 67.7 分,FrontierSWE 得分 73.5 分 |
| 科学研究 | FrontierMath Tier 4 得分 97.6% | FrontierMath Tier 4 得分 87.8% | 未公布同口径数据 | PaperBench 得分 93.0 分 |
| 安全与对齐 | 越权比例 0%,不当行为率 2.4% | 不当行为率 9.5% | 未公布同口径数据 | 未公布同口径数据 |
整体看,GPT-6 Astra 的优势在计算机操作、抽象推理,ARC-AGI-3 从 Sol 的 7.8% 跃至 99.9% 最见代际差;Claude Fable 5.1 是稳定通用旗舰,Muse Spark 1.3 以低价切入长周期,Qwen 3.8-Max 是四款中唯一计划开放权重者。注意 Terminal-Bench 有 2.1 与 4.0 两版,后两款成绩来自 2.1,勿直接相减。
Astra 的长程上下文依托 Codex 执行框架,想了解其边界,可参考 Codex Harness(OpenAI 开源的 AI Agent 执行框架,负责编排工具调用与长任务上下文)。
GPT-6 Astra 的应用场景与适用人群
- 软件工程与数据库迁移:自主完成代码编写、调试与迁移,长时任务保留失败原因与测试异常等关键细节。
- 科研数据分析:进入专业科学软件检查测序数据、分析遗传变异、运行模拟并拟合模型。
- 办公自动化:操作电子表格与演示工具,完成填表、CRM 更新与日程整理,按模板产出文档与幻灯片。
适用人群:需把跨软件重复流程交 AI 的企业团队最先受益,尤其软件工程、数据分析与网络安全从业者。开发者用它处理迁移长任务,科研人员用它进专业软件跑流程。最强网络安全能力仅向 Daybreak 项目内审核团队开放。
如何使用 GPT-6 Astra
Astra 采用分阶段开放,普通用户暂时无法直接使用。按以下顺序即可接入。
- 确认开放资格:访问 GPT-6 Astra 官网 查看开放范围,企业与安全团队可通过 Daybreak 项目申请,ChatGPT 订阅用户未来数日内陆续获得权限。
- 切换模型:在 ChatGPT 客户端切换到 GPT-6 Astra,或在 API 调用中使用模型名 gpt-6-astra。
- 下达完整目标:用自然语言给出最终目标,例如「整理一份财务分析并做成演示文稿」,由模型自行拆解。
- 开启计算机操作:在支持 Computer Use 的界面开启功能,授权模型操作软件、浏览网页与调用外部工具。
- 过程确认与交付:根据进度确认关键节点或中途追加要求,模型会保持原始目标继续推进至产出成果。
GPT-6 Astra 的价格与开源情况
GPT-6 Astra 为闭源,仅通过 ChatGPT 订阅、OpenAI API 或亚马逊云调用。API 定价每百万 tokens 输入 10 美元、输出 50 美元,与 Claude Fable 5.1 持平,约为 GPT-5.6 Sol 促销价 2.5 倍,另有 Pro 档面向高阶订阅。
单价高不意味总账单高。OpenAI 强调 Astra 输出 token 更少,最高分设置下比 Claude Opus 5 少约 65%,BenchCAD 估算比 Sol 低约 43%。另提供 Fast Mode,速度为标准 2.5 倍、价格两倍。
GPT-6 Astra 常见问题
GPT-6 Astra 是什么?
GPT-6 Astra 是 OpenAI 于 2026 年 9 月推出的新一代旗舰大模型,官方称全球最智能、最对齐。核心变化是能直接进入软件执行任务,覆盖计算机操作、软件工程、科研与网络安全。
GPT-6 Astra 什么时候开放给普通用户?
发布当天率先向 Daybreak 项目组织与企业开放,随后数日内向 ChatGPT Plus、Pro、Business 与 Enterprise 推出,同时经 OpenAI API 与亚马逊云提供。
GPT-6 Astra 的价格是多少?
API 定价每百万 tokens 输入 10 美元、输出 50 美元,是 GPT-5.6 Sol 促销价 2.5 倍,与 Claude Fable 5.1 持平。另有 Fast Mode,速度 2.5 倍、价格两倍。
GPT-6 Astra 的网络安全能力会完全开放吗?
不会。Astra 是首个达「关键级」网络安全门槛的模型,普通版仅用于安全审查与漏洞修复,拒为漏洞建 PoC。限制更少版本经 Daybreak 项目逐步开放给审核通过的防御场景。
浙公网安备33010202004812号