10月8日,OpenAI正式在API、Codex和ChatGPT Work中推出GPT-6.1 Sol的Ultrafast版本。该版本运行速度最高可达标准版的8倍(约300 tokens/秒),定价为标准版的6倍——每百万输入Token 12美元、每百万输出Token 60美元。
这是OpenAI继9月底DevDay发布Ultrafast模式后,将该能力从旗舰模型GPT-6 Astra“下放”至性价比主力Sol的标志性动作,也是“速度”被正式产品化、定价化的关键一步。
同一个模型,两种速度:Ultrafast不是新模型
Ultrafast的本质是一个服务层级(service_tier),而非第二个模型。开发者通过设置`service_tier: “ultrafast”`调用`gpt-6.1-sol`,模型权重、上下文窗口(105万Token)、知识截止日期(2026年4月30日)全部不变。
你多付的钱,买的不是更聪明的AI,而是更短的等待。OpenAI官方对Ultrafast的定义也刻意保守:“缩短生成输出Token之间的时间”。
价格梯度:三档速度,六倍溢价
GPT-6.1 Sol现在按速度分为三档:
Ultrafast的定价恰好是标准版的6倍。值得注意的是,缓存读取价格为0.60美元/百万Token,同样按6倍放大。
谁需要为速度买单?
Ultrafast的价值高度依赖场景。OpenAI给出的典型用例是实时编码助手、交互式智能体和面向客户的实时体验。
对于持续运行的编码智能体,优势是复合累积的:如果一个任务需要12轮工具调用,每轮生成速度提升8倍,总完成时间的缩短远不止“快一点”。有开发者实测,标准版Sol输出速度约42 tokens/秒,Ultrafast达到304 tokens/秒,快了7倍多;从提问到出第一个字,等待时间从7.1秒降至2.9秒,整段回答从17秒缩短至4.3秒。
但对于单次复杂推理请求,大部分时间花在“思考”而非“输出”上,付6倍价格可能只是盯着同一个加载圈少等一会儿。
开放范围:Pro 500与企业的“特权”
在API端,Ultrafast对所有API用户开放,按量付费。
但在Codex和ChatGPT Work中,Ultrafast仅面向Pro 500订阅用户(月费500美元)、符合条件的按量付费企业版,以及配额计费的教育版开放,企业用户需管理员手动开启。
Pro 500的算力额度是Plus的25倍,但Ultrafast按标准档的8倍扣减额度。这意味着25倍额度全用来跑Ultrafast,仅相当于3个多Plus的用量。
数据驻留与合规
GPT-6.1 Sol Ultrafast全面支持美国和欧盟的数据驻留合规服务。值得注意的是,旗舰模型GPT-6 Astra的Ultrafast版本仅支持美国数据驻留,而Sol则覆盖了欧盟(EEA+瑞士)。对于有欧盟数据合规要求的企业,这是一个实质性的差异化优势。
Ultrafast的推出,标志着OpenAI对“速度”这一维度的正式定价。在AI智能体从“问答工具”走向“持续运行的生产力”的过程中,延迟正在成为与智能同等重要的变量。当AI帮你写代码、操作软件、处理工单时,每一秒的等待都意味着工作流的阻塞和注意力的流失。
6倍价格换8倍速度,这笔账是否划算,取决于你的业务场景中“人等待AI”的成本有多高。对于高频调用的智能体流水线,Ultrafast可能是必需品;对于个人用户的日常对话,标准版已经足够。OpenAI没有试图让所有人升级,而是把选择权交给开发者,用价格信号引导资源分配。
从更大的视角看,Ultrafast是“推理算力分层”的必然结果。当模型能力趋同,算力成本成为竞争焦点时,用价格区分服务等级,是云服务行业验证过的成熟模式。OpenAI正在把AI推理变成一门精细化的算力生意。