OpenAI 发布 GPT-6.1 Sol:接近 Astra 的性能、五分之一的价格
OpenAI 在 DevDay 发布 GPT-6.1 Sol:性能接近 Astra、价格仅五分之一,已上线 Work 与 Codex。

OpenAI 在 DevDay 发布 GPT-6.1 Sol:官方称其在智能体编码、电脑操作与专业工作上接近 GPT-6 Astra,而标准价格仅为其五分之一。两天前 GPT-6.1 Astra 刚被叫停发布,如今顶上来的不是更强的模型,而是更便宜的模型。
事实部分
- 定价:每百万 token 输入 2 美元、缓存输入 0.10 美元(比 GPT-6 Sol 的缓存价再低 50%)、输出 10 美元——约为 Astra 标准价的五分之一;API 名称
gpt-6.1-sol。 - 基准(官方口径):DeepSWE v1.1 以约五分之一成本追平 Astra、比 GPT-6 Sol 高 6.4 个百分点;OSWorld 2.0 距 Astra 2.1 个百分点、单任务成本约七分之一;Terminal-Bench Science 单任务 5.47 美元(Opus 5.5 为 23.21 美元、Astra 23.80 美元)。
- 事实性:低推理强度下的事实错误占比从 11.4% 降到 7.7%(约降 32%)。
- 对齐:未披露破损搜索工具的比例 2.1%(GPT-6 Sol 为 4.9%、Astra 为 1.5%);官方称未观察到绕过自动安全审查的尝试。
- 可用性:即日向 ChatGPT Work 与 Codex 的 Plus/Pro/Business/Enterprise/Edu 用户开放,Chat 端暂未上线;Ultrafast 模式(至多 8 倍生成提速)将在几天内到来。
- 信源说明:以上均为 OpenAI 自报口径。发布页未提 Astra 6.1 叫停一事,两者的关联是时间线上的事实而非官方表述。
编辑判断
这条发布和两天前的叫停放在一起看才完整:安全测试拦下了最强的模型,商品化没有停——「接近 Astra 的性能、五分之一的价格」就是对齐税的定价方式。对跑批量智能体任务的团队,OSWorld 的「七分之一成本」与 Terminal-Bench Science 的「五分之一价格」是可直接套进成本模型的两个数;接 GPT-6 Sol 与 Luna 的存量调用值得重跑一轮对比。注意 Chat 端还没上线,别在对话产品里找不到它。