GPT-6 Astra – OpenAI推出的全球最智能对齐旗舰大模型

AI模型3天前更新 智小研
55 0

GPT-6 Astra是一款由OpenAI推出的新一代旗舰大模型,主要用于计算机操作、软件工程与科学研究等完整工作流程,支持自主填写表单、更新 CRM 记录、分析科学数据并生成图表,适用于需要 AI 独立交付成果的开发者、科研人员与企业团队。

基础信息内容
产品定位全球最智能、对齐程度最高的旗舰大模型,主打计算机操作
开发方OpenAI
发布时间2026 年 9 月 3 日(当地时间)
训练规模得州 Stargate 基地,首次超过 10 万张 GPU 预训练
计算机操作OSWorld 2.0 得分 72.6%,ScreenSpot-Pro 得分 92.7%
关键基准ARC-AGI-3 得分 99.9%,FrontierMath Tier 4 得分 97.6%
API 定价输入 10 美元/百万 tokens,输出 50 美元/百万 tokens
开放方式闭源,通过 ChatGPT、OpenAI API 与亚马逊云服务提供
GPT-6 Astra – OpenAI推出的全球最智能对齐旗舰大模型

GPT-6 Astra 的核心能力

计算机操作:从给建议到直接干活

Astra 可自主填表、更新 CRM、整理日程,也能在线研究并把结论写入邮件或文档;遇软件问题可自主安装排查。在 OSWorld 2.0 测试中得分 72.6%(GPT-5.6 Sol 为 65.7%)。

软件工程:长程任务不再丢上下文

Astra 在 Terminal-Bench 4.0 得分约 58%,高于 GPT-5.6 Sol 的 37.3% 与 Claude Fable 5.1 的 55.8%;内部数据库迁移达 63.9%(Sol 为 42.7%)。关键在上下文机制:旧模型装满会压成摘要、丢细节,Astra 可跨窗口存笔记、完整历史可检索。思路与同周 Gemini 3.8 相近。

科学研究:进入专业软件而非只做文字推演

Astra 在 GPQA Diamond 达 96.0%,FrontierMath Tier 4 达 97.6%(GPT-5.6 Sol 为 83.0% 与 22.4%)。OpenAI 称其已参与部分长期未解数学问题,还能进专业软件检查测序数据、运行模拟。

网络安全与对齐:能力最强,边界也更硬

Astra 是 OpenAI 首个达内部「关键级」网络安全门槛的模型,ExploitBench 得分 100%(Sol 为 78.5%);新漏洞测试集上任意代码执行成功率 39%(Sol 仅 5.5%)。同类产品还有 Claude Mythos 5.1,同样以网络安全特化见长。

能力上去了,越界反而下降。越权测试中 GPT-5.6 Sol 无防护时约 48% 超授权,Astra 为 0%;计算机操作安全不当行为率 2.4%(Sol 为 22.0%)。

GPT-6 Astra 与同类模型的对比

2026 年 9 月首周旗舰密集发布,Meta、Anthropic 与谷歌一周内更新主力,下表选三款旗舰横向比较。

对比维度GPT-6 AstraClaude Fable 5.1Muse Spark 1.3Qwen 3.8-Max
开发方OpenAIAnthropicMeta 超级智能实验室阿里通义千问
产品定位最智能、最对齐的旗舰,主打计算机操作通用旗舰,偏编程与科研长周期智能体与编码旗舰旗舰智能体,覆盖编程与科研
计算机操作OSWorld 2.0 得分 72.6%ScreenSpot-Pro 得分 87.3%未公布同口径数据未公布同口径数据
软件工程DeepSWE v1.1 得分 74.1%,Terminal-Bench 4.0 约 58%DeepSWE v1.1 得分 67.4%,Terminal-Bench 4.0 得分 55.8%DeepSWE v1.1 得分 75.4%,Terminal-Bench 2.1 得分 88.8 分SWE-bench Pro 得分 67.7 分,FrontierSWE 得分 73.5 分
科学研究FrontierMath Tier 4 得分 97.6%FrontierMath Tier 4 得分 87.8%未公布同口径数据PaperBench 得分 93.0 分
安全与对齐越权比例 0%,不当行为率 2.4%不当行为率 9.5%未公布同口径数据未公布同口径数据

整体看,GPT-6 Astra 的优势在计算机操作、抽象推理,ARC-AGI-3 从 Sol 的 7.8% 跃至 99.9% 最见代际差;Claude Fable 5.1 是稳定通用旗舰,Muse Spark 1.3 以低价切入长周期,Qwen 3.8-Max 是四款中唯一计划开放权重者。注意 Terminal-Bench 有 2.1 与 4.0 两版,后两款成绩来自 2.1,勿直接相减。

Astra 的长程上下文依托 Codex 执行框架,想了解其边界,可参考 Codex Harness(OpenAI 开源的 AI Agent 执行框架,负责编排工具调用与长任务上下文)。

GPT-6 Astra 的应用场景与适用人群

  • 软件工程与数据库迁移:自主完成代码编写、调试与迁移,长时任务保留失败原因与测试异常等关键细节。
  • 科研数据分析:进入专业科学软件检查测序数据、分析遗传变异、运行模拟并拟合模型。
  • 办公自动化:操作电子表格与演示工具,完成填表、CRM 更新与日程整理,按模板产出文档与幻灯片。

适用人群:需把跨软件重复流程交 AI 的企业团队最先受益,尤其软件工程、数据分析与网络安全从业者。开发者用它处理迁移长任务,科研人员用它进专业软件跑流程。最强网络安全能力仅向 Daybreak 项目内审核团队开放。

如何使用 GPT-6 Astra

Astra 采用分阶段开放,普通用户暂时无法直接使用。按以下顺序即可接入。

  1. 确认开放资格:访问 GPT-6 Astra 官网 查看开放范围,企业与安全团队可通过 Daybreak 项目申请,ChatGPT 订阅用户未来数日内陆续获得权限。
  2. 切换模型:在 ChatGPT 客户端切换到 GPT-6 Astra,或在 API 调用中使用模型名 gpt-6-astra。
  3. 下达完整目标:用自然语言给出最终目标,例如「整理一份财务分析并做成演示文稿」,由模型自行拆解。
  4. 开启计算机操作:在支持 Computer Use 的界面开启功能,授权模型操作软件、浏览网页与调用外部工具。
  5. 过程确认与交付:根据进度确认关键节点或中途追加要求,模型会保持原始目标继续推进至产出成果。

GPT-6 Astra 的价格与开源情况

GPT-6 Astra 为闭源,仅通过 ChatGPT 订阅、OpenAI API 或亚马逊云调用。API 定价每百万 tokens 输入 10 美元、输出 50 美元,与 Claude Fable 5.1 持平,约为 GPT-5.6 Sol 促销价 2.5 倍,另有 Pro 档面向高阶订阅。

单价高不意味总账单高。OpenAI 强调 Astra 输出 token 更少,最高分设置下比 Claude Opus 5 少约 65%,BenchCAD 估算比 Sol 低约 43%。另提供 Fast Mode,速度为标准 2.5 倍、价格两倍。

GPT-6 Astra 常见问题

GPT-6 Astra 是什么?

GPT-6 Astra 是 OpenAI 于 2026 年 9 月推出的新一代旗舰大模型,官方称全球最智能、最对齐。核心变化是能直接进入软件执行任务,覆盖计算机操作、软件工程、科研与网络安全。

GPT-6 Astra 什么时候开放给普通用户?

发布当天率先向 Daybreak 项目组织与企业开放,随后数日内向 ChatGPT Plus、Pro、Business 与 Enterprise 推出,同时经 OpenAI API 与亚马逊云提供。

GPT-6 Astra 的价格是多少?

API 定价每百万 tokens 输入 10 美元、输出 50 美元,是 GPT-5.6 Sol 促销价 2.5 倍,与 Claude Fable 5.1 持平。另有 Fast Mode,速度 2.5 倍、价格两倍。

GPT-6 Astra 的网络安全能力会完全开放吗?

不会。Astra 是首个达「关键级」网络安全门槛的模型,普通版仅用于安全审查与漏洞修复,拒为漏洞建 PoC。限制更少版本经 Daybreak 项目逐步开放给审核通过的防御场景。

© 版权声明
AI工具站赚钱操作手册横幅,分享AI工具站SEO、GEO流量增长、CPS、CPA及数字产品变现经验

相关文章