GPT-6.1 Sol是一款由OpenAI于2026年9月推出的新一代主力大模型,主要用于智能体编程、电脑操作与专业工作三类场景,支持多档推理强度调节与上下文缓存,适用于长周期智能体、软件工程与企业流程自动化等方向。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | 面向智能体编程与专业工作的主力模型 |
| 出品方 | OpenAI |
| 发布时间 | 2026年9月29日(当地时间) |
| 模型系列 | GPT-6 系列(Astra 能力下放版本) |
| 推理强度 | 多档可调(low 至 max) |
| 输入价格 | 每百万 tokens 2 美元 |
| 缓存读取 | 每百万 tokens 0.10 美元 |
| 输出价格 | 每百万 tokens 10 美元 |
| 可用渠道 | ChatGPT Work、Codex 与 API |
| 开源情况 | 未开放模型权重 |

GPT-6.1 Sol 的核心能力
GPT-6.1 Sol 是 GPT-6 Sol 的大版本升级,官方给出的口径是「智能水平接近 GPT-6 Astra,标准输入、输出 Token 价格只有后者的五分之一」。对以 AI模型 为主要负载的团队而言,单次任务的单价直接决定流程能否规模化铺设。
旗舰能力下放的成本档位
OpenAI 在 GPT-6 系列中的分工是:Astra 承担前沿探索,其余版本承担规模化铺开。GPT-6.1 Sol 沿用同一套训练方法,重点加强智能体编程、电脑操作与专业工作三类后训练,官方称在上述任务上的能力接近 Astra,而标准 Token 价格仅为五分之一。
智能体编程:真实代码库任务
在考查真实代码库长流程软件工程任务的 DeepSWE v1.1 上,GPT-6.1 Sol 已经可以匹配 GPT-6 Astra,相比 GPT-6 Sol 的最高成绩提高 6.4 个百分点。这类评测要求模型自行跨文件定位、运行测试并在失败后反复纠错,对应的正是无人值守的长周期编码负载。
电脑操作与跨软件流程
OSWorld 2.0 的电脑操作评测中,GPT-6.1 Sol 相比 GPT-6 Sol 提高 7 个百分点,距离 Astra 只差 2.1 个百分点。落到 AI 智能体 的实际用法上,填表、录入、跨软件搬运信息这类此前需要逐步指挥的操作可以由模型连续完成,人工只保留关键节点的确认。
专业文档与业务流程处理
专业文档场景中,GPT-6.1 Sol 在 GDP.pdf 评测上超过 Claude Opus 5.5,单任务成本不到其一半;业务流程场景中,它在 AutomationBench 上以中等推理强度比 Claude Opus 5.5 高 2.2 个百分点,成本约为其三分之一。
事实准确性与缓存成本控制
事实性方面,低推理强度下的事实错误率从 11.4% 降至 7.7%,高推理强度下为 4.1%。成本方面,缓存输入价格压到每百万 Token 0.10 美元,为标准输入价的二十分之一;智能体复用同一份上下文时,服务端只对新增的增量输入计费。
Ultrafast 高速档与多档推理强度
OpenAI 同步推出 Ultrafast 付费提速档位,Codex 中的 Token 生成速度最高约 300 tokens/s、官方称最高提速 8 倍,API 接口最高约 6 倍。推理强度则支持从低到多档可调,低档位响应快、成本低,复杂任务再提升档位。
GPT-6.1 Sol 与同类主力模型的对比
| 对比维度 | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|---|
| 开发方 | OpenAI | OpenAI | OpenAI | Anthropic |
| 模型定位 | 新一代主力大模型 | 中高端通用与智能体模型 | 旗舰通用与对齐模型 | Claude 5.5 系列首款旗舰 |
| 输入价格 | 2 美元 | 2 美元 | 10 美元 | 4 美元 |
| 输出价格 | 10 美元 | 10 美元 | 50 美元 | 20 美元 |
| 缓存读取 | 0.10 美元 | 0.20 美元 | 1 美元 | 0.20 美元 |
| OSWorld 2.0 | 较 GPT-6 Sol 提升 7 个百分点 | 60.5%(xhigh 强度) | 72.6% | 81.8% |
| AutomationBench | 中等推理强度较 Claude Opus 5.5 高 2.2 个百分点 | 33.2%(xhigh 强度) | 41.4% | 40.0% |
上表 GPT-6.1 Sol、GPT-6 Sol 与 GPT-6 Astra 三列取自 OpenAI 官方发布材料,Claude Opus 5.5 一列取自 Anthropic 官方公告与官方定价页。差异集中在价格与单位任务成本:前两款同为每百万 tokens 输入 2 美元、输出 10 美元,缓存读取低至 0.10 美元,GPT-6 Astra 为输入 10 美元、输出 50 美元,Claude Opus 5.5 为输入 4 美元、输出 20 美元。能力侧上,GPT-6.1 Sol 在真实代码库任务上追平 Astra,电脑操作差距压到 2.1 个百分点。需要注意,GPT-6.1 Sol 一列为官方相对口径,另三列为各自公布的同名基准绝对分,档位与评测口径并不完全一致,不作直接相减。
如果需要把大量高频、低难度的请求从主力档位分流出去,可以参考同批发布的 GPT-6 Luna(OpenAI 面向高频调用的轻量级模型,输入 0.10 美元、输出 0.50 美元)。
GPT-6.1 Sol 的应用场景与适用人群
该模型面向以调用量核算成本的长周期任务,常见场景包括:
- 智能体编程:跨文件重构、批量代码修改与回归测试,在真实代码库任务上接近旗舰水平。
- 桌面流程自动化:跨软件的填表、录入与信息核对,先在只读环节验证行为边界。
- 专业文档处理:长文档解析、摘要与批量问答,配合缓存折扣压低边际成本。
- 跨应用业务流程:销售、财务与客服系统的串联操作,按任务难度分档配置推理强度。
适用人群:以调用量核算成本的产品与工程团队、需要长期无人值守智能体的企业后台部门,以及在预算内追求接近旗舰表现的中小团队。对数据出境与合规有硬性要求的用户,应先确认所用渠道的数据处理条款。
GPT-6.1 Sol 的使用方法
GPT-6.1 Sol 已通过 ChatGPT Work、Codex 与 API 开放,按以下步骤开始:
- 查看官方说明:在 GPT-6.1 Sol 官方公告 中确认价格、可用档位与开放范围。
- 选择入口:在 ChatGPT Work 或 Codex 的模型选择器中切换至 GPT-6.1 Sol,普通 ChatGPT 对话暂未提供该模型。
- 配置 API 调用:在请求中把模型名设为
gpt-6.1-sol,并按任务难度选择推理强度档位。 - 启用上下文缓存:跨请求复用系统提示与任务上下文,缓存输入按每百万 tokens 0.10 美元计费。
- 按需开启 Ultrafast:对延迟敏感的环节通过 API 或 Pro 500 档位启用最高 8 倍速的生成。
使用中建议先用低档推理验证输出质量与延迟,再对复杂任务逐档上调;涉及写操作的工具调用保留人工确认环节。
GPT-6.1 Sol 的价格与开源情况
GPT-6.1 Sol 的标准 API 定价为每百万 tokens 输入 2 美元、输出 10 美元、缓存输入 0.10 美元,输入与输出价格均为 GPT-6 Astra 的五分之一,缓存读取比 GPT-6 Sol 再降一半。Ultrafast 为付费提速档位,Codex 中最高约 300 tokens/s、官方称最高提速 8 倍,API 接口最高约 6 倍,代价是更高的计费倍率。订阅侧,每月 200 美元的 Pro 套餐在本轮恢复开放,并新增每月 500 美元的 Pro 500,后者额度约为 ChatGPT Plus 的 25 倍。
GPT-6.1 Sol 未开放模型权重,仅通过 ChatGPT Work、Codex 与 OpenAI API 提供,自托管与私有化部署不在可选范围内。对成本敏感的团队而言,缓存命中率与推理强度是决定真实支出的两个变量,建议接入时按任务难度分级配置。
GPT-6.1 Sol 的常见问题
GPT-6.1 Sol 与 GPT-6 Astra 有什么区别?
两者训练方法接近。Astra 是旗舰模型,官方称其仍是整体最强、追求无妥协体验的首选;GPT-6.1 Sol 把 Astra 在智能体编程、电脑操作与专业工作上的表现放进更低的成本区间,价格只有前者的五分之一。
GPT-6.1 Sol 怎么使用,普通 ChatGPT 用户能用吗?
该模型已在 ChatGPT Work 与 Codex 中提供,普通 ChatGPT 对话暂未提供。开发者可在 API 中把模型名设为 gpt-6.1-sol 直接调用,并按任务难度选择推理强度档位。
GPT-6.1 Sol 的价格是多少?
标准 API 定价为每百万 tokens 输入 2 美元、输出 10 美元、缓存输入 0.10 美元。Ultrafast 高速档按更高倍率单独计费,Pro 套餐每月 200 美元起,新增的 Pro 500 为每月 500 美元。
浙公网安备33010202004812号