模型#模型推理

GPT-6.1 Sol 上线 Ultrafast:快 8 倍,价格也是 6 倍

OpenAI 为 GPT-6.1 Sol 开启 Ultrafast 档:最快 8 倍速度,$12/$60 定价,ChatGPT 端仅限 Pro 500 订阅。

OpenAI 开发者文档风格的 Ultrafast mode 卡片,橙粉渐变背景

10 月 8 至 9 日,OpenAI 把 Ultrafast 高速模式从旗舰 Astra 下放到主力档 GPT-6.1 Sol:据机器之心等媒体报道,开发者在 API 里调用 gpt-6.1-sol 并开启 Ultrafast,即可获得最高 8 倍于标准版的速度,官方称智能水平保持「接近 Astra」。价格随之跳档——输入 12 美元、输出 60 美元每百万 token,是标准版的 6 倍。这是 OpenAI 产品负责人 Tibo「连续 28 天发布」活动的第四天,前一天 GPT-6 刚刚向全部用户开放。

要点

  • 8 倍速度、6 倍价格:Sol Ultrafast 定价输入 12 美元/输出 60 美元(每百万 token),速度最高 8 倍,官方口径是「接近 Astra 的智能,Sol 五分之一价钱的延续」。
  • ChatGPT 端有门槛:API 对所有开发者按量开放;ChatGPT 与 Codex 端仅向 500 美元/月的 Pro 500 订阅和部分企业、教育客户开放,已有开发者抱怨用量额度消耗过快。
  • 算力在谁手里:据 OfficeChai 转述 SemiAnalysis 的分析,Ultrafast 由 Nvidia GPU 承载;8 月的 GPT-5.6 Sol Ultrafast 预览版曾由 Cerebras 承载。

背景

「Ultrafast」是 OpenAI 在 8 月 13 日预览 GPT-5.6 Sol 时引入的档位——当时与 Cerebras 合作,官方给出过 14 倍速度的数字;9 月 29 日 DevDay 上,该模式先落到旗舰 Astra 上。Sol 是 OpenAI 的走量档:按 VentureBeat 9 月底的报道,GPT-6.1 Sol 以约五分之一的价格提供接近 Astra 的性能,每秒约 300 token 的输出。把 Ultrafast 下放到走量档,等于把「低延迟」从旗舰特权变成了明码标价的选项。值得注意的是,旗舰 Astra 曾因安全原因短暂下架,其 Ultrafast 档的 EU 数据驻留此前也一直是缺口。

事实部分

档位API 价格(每百万 token,输入/输出)说明
GPT-6.1 Sol 标准版$2 / $10走量档,DevDay 定价
GPT-6.1 Sol Ultrafast$12 / $60最高 8 倍速度,本次新上线
GPT-6 Astra(参照)$10 / $50旗舰档,官方称 Sol 智能接近 Astra

几个可核对的细节:其一,据 MIXED Reality News,EU 数据驻留支持 Sol Ultrafast,而 Astra 的 Ultrafast 暂不支持——欧洲企业客户要低延迟只能选 Sol 档。其二,API 端按量付费无用量上限;ChatGPT 与 Codex 端的门槛是 500 美元/月的 Pro 500 订阅,外加部分按量付费的企业与教育合同。其三,机器之心转述了开发者的实际体验:有用户称 Pro 500 档 25 倍的用量额度「几分钟就能烧掉 1%」——高速档的消耗速度是按 token 计费的直接放大器。

各方说法

OfficeChai 转述 SemiAnalysis 的供应链分析称,这一代 Ultrafast 跑在 Nvidia GPU 上,而非 8 月预览时的 Cerebras——后者股价此前已因「OpenAI 转向 Nvidia」的报道波动,这条信息若属实,等于坐实了合作关系的迁移,但目前属于分析机构结论,OpenAI 未确认。MIXED Reality News 则从合规角度切入,指出 EU 数据驻留的档位差异会影响欧洲企业的选型。机器之心关注的是开发者情绪:定价是标准版 6 倍、消费端又被锁进最高档订阅,两处都有不满的声音。

编辑判断

「用钱换延迟」正式成为 API 的一等维度,这比模型迭代对工程决策的影响更直接:实时语音、编码智能体、浏览器自动化这些对首 token 延迟敏感的场景,现在可以在同一模型的两个价签之间做成本收益计算——每秒多花的钱,要靠省下的等待时间和更高的任务吞吐赚回来。谁该关心:跑实时交互智能体的团队;谁可以先不关心:批处理和分析类负载,标准版的性价比没变。诚实的不确定性:8 倍是官方口径的「最高」,实际负载下的分位延迟没有第三方基准;Nvidia 承载说出自分析机构,未经官方证实。

怎么试

API 用户直接调用 gpt-6.1-sol 并在参数中开启 Ultrafast,按量计费无用量上限;ChatGPT 与 Codex 用户需要 Pro 500(500 美元/月)或对应的企业、教育合同。建议先拿真实工作负载压一轮 p99 延迟,再决定是否把关键路径切过去。