IT之家 9 月 30 日消息,在今天召开的 OpenAI 开发者活动日中,官方正式宣布推出 GPT-6.1 Sol 模型。在性能接近 Astra 的同时,其费用仅为 Astra 的五分之一。官方称,这是“在目前同等性能下性价比最高的模型”。

GPT‑6 Astra 是 OpenAI 在 2026 年 9 月推出的旗舰级大语言模型,官方定位为“迄今最智能、最对齐(最符合人类意图)”的模型,重点面向长程多步骤任务与专业工作流。
费用方面,根据官网公布的费用细节,IT之家称,gpt-6.1-sol 在短上下文和长上下文场景下均提供全模式定价,其中短上下文适用于输入 tokens 不超过 272,000,长上下文适用于输入 tokens 超过 272,000。报道未列出具体表格数值,但提到上述共有 4 种处理模式。
在性价比方面,官方表示,GPT-6.1 Sol 模型每 100 万 Token 的缓存费用为 0.1 美元。IT之家注称,按现汇率约合 0.67 元人民币。相较 GPT-6 Sol,该定价低 50%。
在性能方面,官方表示,GPT‑6.1 Sol 在智能体编程、电脑操作和专业工作流等任务上的表现接近旗舰 GPT‑6 Astra,但标准输入和输出 token 价格只有 Astra 的五分之一。
具体来看:
- 软件工程(DeepSWE v1.1):在较高推理强度下,GPT‑6.1 Sol 的表现与 GPT‑6 Astra 相当;在较低推理强度和成本条件下,其得分比 GPT‑6 Sol 高出 6.4 个百分点。
- 专业文档与复杂任务(GDP.pdf):以不到 Opus 5.5 一半的任务成本,取得更好结果。
- 自动化工作流(AutomationBench,中等推理强度):得分比 Opus 5.5 高 2.2 个百分点,成本约为其三分之一。
- 电脑操作(OSWorld 2.0 离线,最大推理强度):得分比 GPT‑6 Sol 高 7 个百分点,成本不足后者一半;与 Astra 相比仅低 2.1 个百分点,但单任务成本约为 Astra 的七分之一。
- 科学终端任务(Terminal‑Bench Science 0.1,最大推理强度):得分是 GPT‑6 Sol 的两倍以上;单任务平均成本为 5.47 美元,显著低于 Opus 5.5 的 23.21 美元和 Astra 的 23.80 美元。
除“能干活”外,官方还表示,GPT‑6.1 Sol 在可靠性与对齐方面也有所改进:

- 事实错误率下降:在低推理强度下,事实错误比例从 GPT‑6 Sol 的 11.4% 降至 7.7%,降幅约 32%。
- 与 Astra 的差距较小:在所有推理设置下,GPT‑6.1 Sol 的错误率与 Astra 的差距控制在 1.9% 以内。
- 更遵守用户意图与安全约束:在困难评测中,更少忽略失效的搜索工具,更能遵循明确限制,并减少未经授权的操作;在安全测试中,未观察到试图绕过自动化安全审查器的行为。
调用方面,官方表示,自 9 月 29 日起,GPT‑6.1 Sol 已向 ChatGPT Work 与 Codex 的 Plus、Pro、Business、Enterprise 和 Edu 用户开放;开发者可通过 API 使用 gpt-6.1-sol 调用该模型。











