GPT-6.1 Sol – OpenAI推出的新一代主力大模型

AI模型4天前更新 老高
32 0

GPT-6.1 Sol是一款由OpenAI于2026年9月推出的新一代主力大模型,主要用于智能体编程、电脑操作与专业工作三类场景,支持多档推理强度调节与上下文缓存,适用于长周期智能体、软件工程与企业流程自动化等方向。

基础信息内容
产品定位面向智能体编程与专业工作的主力模型
出品方OpenAI
发布时间2026年9月29日(当地时间)
模型系列GPT-6 系列(Astra 能力下放版本)
推理强度多档可调(low 至 max)
输入价格每百万 tokens 2 美元
缓存读取每百万 tokens 0.10 美元
输出价格每百万 tokens 10 美元
可用渠道ChatGPT Work、Codex 与 API
开源情况未开放模型权重
GPT-6.1 Sol – OpenAI推出的新一代主力大模型

GPT-6.1 Sol 的核心能力

GPT-6.1 Sol 是 GPT-6 Sol 的大版本升级,官方给出的口径是「智能水平接近 GPT-6 Astra,标准输入、输出 Token 价格只有后者的五分之一」。对以 AI模型 为主要负载的团队而言,单次任务的单价直接决定流程能否规模化铺设。

旗舰能力下放的成本档位

OpenAI 在 GPT-6 系列中的分工是:Astra 承担前沿探索,其余版本承担规模化铺开。GPT-6.1 Sol 沿用同一套训练方法,重点加强智能体编程、电脑操作与专业工作三类后训练,官方称在上述任务上的能力接近 Astra,而标准 Token 价格仅为五分之一。

智能体编程:真实代码库任务

在考查真实代码库长流程软件工程任务的 DeepSWE v1.1 上,GPT-6.1 Sol 已经可以匹配 GPT-6 Astra,相比 GPT-6 Sol 的最高成绩提高 6.4 个百分点。这类评测要求模型自行跨文件定位、运行测试并在失败后反复纠错,对应的正是无人值守的长周期编码负载。

电脑操作与跨软件流程

OSWorld 2.0 的电脑操作评测中,GPT-6.1 Sol 相比 GPT-6 Sol 提高 7 个百分点,距离 Astra 只差 2.1 个百分点。落到 AI 智能体 的实际用法上,填表、录入、跨软件搬运信息这类此前需要逐步指挥的操作可以由模型连续完成,人工只保留关键节点的确认。

专业文档与业务流程处理

专业文档场景中,GPT-6.1 Sol 在 GDP.pdf 评测上超过 Claude Opus 5.5,单任务成本不到其一半;业务流程场景中,它在 AutomationBench 上以中等推理强度比 Claude Opus 5.5 高 2.2 个百分点,成本约为其三分之一。

事实准确性与缓存成本控制

事实性方面,低推理强度下的事实错误率从 11.4% 降至 7.7%,高推理强度下为 4.1%。成本方面,缓存输入价格压到每百万 Token 0.10 美元,为标准输入价的二十分之一;智能体复用同一份上下文时,服务端只对新增的增量输入计费。

Ultrafast 高速档与多档推理强度

OpenAI 同步推出 Ultrafast 付费提速档位,Codex 中的 Token 生成速度最高约 300 tokens/s、官方称最高提速 8 倍,API 接口最高约 6 倍。推理强度则支持从低到多档可调,低档位响应快、成本低,复杂任务再提升档位。

GPT-6.1 Sol 与同类主力模型的对比

对比维度GPT-6.1 SolGPT-6 SolGPT-6 AstraClaude Opus 5.5
开发方OpenAIOpenAIOpenAIAnthropic
模型定位新一代主力大模型中高端通用与智能体模型旗舰通用与对齐模型Claude 5.5 系列首款旗舰
输入价格2 美元2 美元10 美元4 美元
输出价格10 美元10 美元50 美元20 美元
缓存读取0.10 美元0.20 美元1 美元0.20 美元
OSWorld 2.0较 GPT-6 Sol 提升 7 个百分点60.5%(xhigh 强度)72.6%81.8%
AutomationBench中等推理强度较 Claude Opus 5.5 高 2.2 个百分点33.2%(xhigh 强度)41.4%40.0%

上表 GPT-6.1 Sol、GPT-6 Sol 与 GPT-6 Astra 三列取自 OpenAI 官方发布材料,Claude Opus 5.5 一列取自 Anthropic 官方公告与官方定价页。差异集中在价格与单位任务成本:前两款同为每百万 tokens 输入 2 美元、输出 10 美元,缓存读取低至 0.10 美元,GPT-6 Astra 为输入 10 美元、输出 50 美元,Claude Opus 5.5 为输入 4 美元、输出 20 美元。能力侧上,GPT-6.1 Sol 在真实代码库任务上追平 Astra,电脑操作差距压到 2.1 个百分点。需要注意,GPT-6.1 Sol 一列为官方相对口径,另三列为各自公布的同名基准绝对分,档位与评测口径并不完全一致,不作直接相减。

如果需要把大量高频、低难度的请求从主力档位分流出去,可以参考同批发布的 GPT-6 Luna(OpenAI 面向高频调用的轻量级模型,输入 0.10 美元、输出 0.50 美元)。

GPT-6.1 Sol 的应用场景与适用人群

该模型面向以调用量核算成本的长周期任务,常见场景包括:

  • 智能体编程:跨文件重构、批量代码修改与回归测试,在真实代码库任务上接近旗舰水平。
  • 桌面流程自动化:跨软件的填表、录入与信息核对,先在只读环节验证行为边界。
  • 专业文档处理:长文档解析、摘要与批量问答,配合缓存折扣压低边际成本。
  • 跨应用业务流程:销售、财务与客服系统的串联操作,按任务难度分档配置推理强度。

适用人群:以调用量核算成本的产品与工程团队、需要长期无人值守智能体的企业后台部门,以及在预算内追求接近旗舰表现的中小团队。对数据出境与合规有硬性要求的用户,应先确认所用渠道的数据处理条款。

GPT-6.1 Sol 的使用方法

GPT-6.1 Sol 已通过 ChatGPT Work、Codex 与 API 开放,按以下步骤开始:

  1. 查看官方说明:在 GPT-6.1 Sol 官方公告 中确认价格、可用档位与开放范围。
  2. 选择入口:在 ChatGPT Work 或 Codex 的模型选择器中切换至 GPT-6.1 Sol,普通 ChatGPT 对话暂未提供该模型。
  3. 配置 API 调用:在请求中把模型名设为 gpt-6.1-sol,并按任务难度选择推理强度档位。
  4. 启用上下文缓存:跨请求复用系统提示与任务上下文,缓存输入按每百万 tokens 0.10 美元计费。
  5. 按需开启 Ultrafast:对延迟敏感的环节通过 API 或 Pro 500 档位启用最高 8 倍速的生成。

使用中建议先用低档推理验证输出质量与延迟,再对复杂任务逐档上调;涉及写操作的工具调用保留人工确认环节。

GPT-6.1 Sol 的价格与开源情况

GPT-6.1 Sol 的标准 API 定价为每百万 tokens 输入 2 美元、输出 10 美元、缓存输入 0.10 美元,输入与输出价格均为 GPT-6 Astra 的五分之一,缓存读取比 GPT-6 Sol 再降一半。Ultrafast 为付费提速档位,Codex 中最高约 300 tokens/s、官方称最高提速 8 倍,API 接口最高约 6 倍,代价是更高的计费倍率。订阅侧,每月 200 美元的 Pro 套餐在本轮恢复开放,并新增每月 500 美元的 Pro 500,后者额度约为 ChatGPT Plus 的 25 倍。

GPT-6.1 Sol 未开放模型权重,仅通过 ChatGPT Work、Codex 与 OpenAI API 提供,自托管与私有化部署不在可选范围内。对成本敏感的团队而言,缓存命中率与推理强度是决定真实支出的两个变量,建议接入时按任务难度分级配置。

GPT-6.1 Sol 的常见问题

GPT-6.1 Sol 与 GPT-6 Astra 有什么区别?

两者训练方法接近。Astra 是旗舰模型,官方称其仍是整体最强、追求无妥协体验的首选;GPT-6.1 Sol 把 Astra 在智能体编程、电脑操作与专业工作上的表现放进更低的成本区间,价格只有前者的五分之一。

GPT-6.1 Sol 怎么使用,普通 ChatGPT 用户能用吗?

该模型已在 ChatGPT Work 与 Codex 中提供,普通 ChatGPT 对话暂未提供。开发者可在 API 中把模型名设为 gpt-6.1-sol 直接调用,并按任务难度选择推理强度档位。

GPT-6.1 Sol 的价格是多少?

标准 API 定价为每百万 tokens 输入 2 美元、输出 10 美元、缓存输入 0.10 美元。Ultrafast 高速档按更高倍率单独计费,Pro 套餐每月 200 美元起,新增的 Pro 500 为每月 500 美元。

© 版权声明

相关文章