当地时间 10 月 8 日,OpenAI Developers 官方正式宣布,GPT-6.1 Sol 的 Ultrafast(极速)版本已在 API、Codex 和 ChatGPT Work 三大入口同步上线。这是 OpenAI 首次将模型的”速度”作为独立服务档位进行单独定价——在智能体时代,等待本身开始有了价格。
三入口齐发,速度最高飙至 8 倍
Ultrafast 版并非全新的模型权重,而是在原有 gpt-6.1-sol 模型基础上新增的服务档位。开发者无需更换模型名称,只需在调用 Responses API 时将服务档位参数 service_tier 设为 ultrafast,即可开启极速模式。
官方称,该版本在保持标准版智能水平不变的前提下,输出 token 生成速度最高可达 Sol 标准版的 8 倍。结合当日同步升级的模型控制系统,模型能够更及时地响应用户的实时指令调整,让智能体在交互过程中”边想边改、实时纠偏”。
API、Codex、ChatGPT Work 三个入口同步开放,覆盖了开发者调用、代码编写与工作流三类核心使用场景。
定价:6 倍价格,换来一场速度与成本的权衡
Ultrafast 版 API 定价为每百万输入 token 12 美元、每百万输出 token 60 美元,恰好是标准版(每百万输入 2 美元、输出 10 美元)的 6 倍。
这一价差结构传递出清晰信号:输出 token 是账单的重心。输入 12 美元、输出 60 美元之间相差整整 5 倍,意味着调用越频繁、生成越长,成本就越向输出端倾斜。
OpenAI 开发者关系工程师 Dominik Kundel 给出了更具冲击力的定位:接近 Astra 级别的智能,8 倍于 Sol 的速度,成本仅为 Astra 的 1.2 倍。对比 Astra 标准 API 每百万输入 10 美元、输出 50 美元的价格,Ultrafast 仅贵出约 20%,却换来了远超 Astra 的响应速度。
定价同样延伸到了缓存与长上下文:
- 短上下文缓存输入由 $0.10 升至 $0.60;
- 输入超过2 万 token 时,长上下文输入升至每百万 24 美元、输出升至 90 美元,且倍率作用于整个请求。
开放范围:API 全员可用,订阅端设有 500 美元门槛
Ultrafast 的开放范围因入口而异:
- API 端:向所有 API 用户开放,但设有独立于标准和快速模式的速率限制;
- Codex 与 ChatGPT Work 端:仅面向 Pro 500 订阅用户、符合条件的按量付费企业版(usage-based Enterprise)及配额计费教育版(credit-based Edu)开放,企业用户需由管理员主动开启权限。
这一门槛在开发者社区引发讨论。不少普通 ChatGPT Plus 甚至 Pro(200 美元/月)用户感叹:”花钱买更快,额度却烧得更狠。” 数据显示,Ultrafast 消耗套餐内含使用额度的速度为标准模式的 8 倍,购买额外 credits 或企业按量付费则按 6 倍倍率计费。
数据驻留与合规:覆盖全区域
面向 GPT-6.1 Sol 的 Ultrafast 版已在所有支持区域上线,并全面支持美国和欧盟境内的数据驻留合规服务。值得注意的是,这是首个支持欧盟数据驻留的 Ultrafast 配置——此前 GPT-6 Astra 的 Ultrafast 并不支持欧盟区域驻留。
为何而战:智能体时代,速度开始单独定价
OpenAI 给出的典型用例包括:线上故障排查、智能体实时导航应用,以及任何”每一秒都在烧钱”的实时交互场景。
OpenAI 官方定位极其克制——Ultrafast 档位”用于缩短生成输出 token 之间的间隔时间”,它不会让模型变得更聪明,也不会缩短思考阶段。这意味着,对于连续调用几十次工具的智能体循环,提速收益会随每一轮输出的提前到达而复利放大;但对于一次性的深度推理任务,用户可能支付 6 倍价格,却看着同样的进度条。
这是 OpenAI 在 Ultrafast 概念上的第二次迭代。今年早些时候,OpenAI 曾与 Cerebras 合作推出 GPT-5.6 Sol 的 Ultrafast 预览版,当时宣称输出速度高达 750 tokens/s,为标准的 14 倍。此次 8 倍的提速幅度看似保守,但由于 6.1 Sol 的智能基线已大幅超越 5.6 Sol,在更高能力基线上做到 8 倍加速,含金量其实更高。
智能体时代的价格战,正在从”谁能想得更好”转向”谁能答得更快”。当等待开始被单独计价,AI 竞争的下一个分水岭,或许已经从模型的能力,悄然转移到了模型的耐心。
—— 本文为原创新闻文章
