GPT-5.6 Sol速度暴涨14倍:OpenAI推出Ultrafast模式

GPT-5.6 Sol 换上一台新加速器,OpenAI 刚放出的 Ultrafast 模式预览版干的就是这件事。底下有 Cerebras 的硬件撑着,推理速度被拉到标准模式的 14 倍,每秒最多能吐出 750 个 token。

GPT-5.6 Sol Ultrafast模式

14 倍这个数,要放回老难题里掂量才有分量。做实时应用的开发者,多年来被一道单选题困着:要 AI 秒回,就得换更小、更专的模型,智能先让一步;要最强模型,就得认下转圈等待。Ultrafast 的目标就是把这道单选题作废,让最强的模型也跑出实时的速度。从前盯着屏幕等十秒的活儿,如今话音刚落,结果已经摆出来了。

快起来之后,哪些生意跟着活了

响应不再吃掉智能,一批对时间极度敏感的业务场景就敞开了门。OpenAI 官方点了几个方向:

  • 故障应急:系统刚出状况的当口翻日志、比对代码变更、读工程师报告,故障还没平息,原因已经锁定,修复方案跟着备好。
  • 金融研究与风控:行情还在跳动的当儿,实时盯住市场信号和交易数据,从流水里把可疑活动挑出来。
  • 客服与语音交互:对话节奏不打断,哪怕要跨多步查询、跨系统调接口,用户的问题也当场办结。
  • 电商:用户犹豫的那几秒里,商品问题实时答、库存实时查、推荐实时给,弃单率往下摁。
  • 科研实验:过去要跑一整夜的批处理实验,改成能来回交互的会话,测一个想法、看结果、调方案、再跑一轮,全程不断线。

这些场景背后是同一个逻辑:慢一步,价值就归零。故障拖十分钟还是拖两小时,是两种性质的事故;用户犹豫的那三秒接没接住话,订单留不留得住就看这一下。

陪跑的第一批客户怎么说

Ultrafast 现在还处在限量预览阶段,OpenAI 拉了一批客户陪跑,专门验证极速推理在哪些场景里最值钱。名单里能看见 Jane Street(金融)、Podium(客服)、Basis(电商)、Rogo(金融研究)。

Jane Street 的 AI 助手团队工程师 John Crepezzi 给出的评价是:Cerebras 带来的速度提升令人印象深刻,它让开发者能以更专注、更高效的方式与模型协作。

OpenAI 拿自己先试了水

自家工程团队的用法最实在:故障告警一响,就拿它飞快扫日志、理调用链、整理上下文,从发现问题到验证修复方案的耗时被压得很短;研究团队则用它提速知识检索和数据查询,原本要过夜跑的批量实验,如今一个工作日内能来回迭代好几轮。

这个细节值得多嘴一句:新功能先砸进自己最疼的环节,这本身就是个信号。极速推理若只是发布会上的噱头,内部犯不着拿它当日常工具。

这回的 Ultrafast,是 OpenAI 与 Cerebras 在超低延迟推理领域的又一次合作推进。眼下只对部分客户开放,往后随产能扩充逐步放开。做实时应用的开发者真正该盯的,不只是这次的 14 倍,而是这条路线一旦验证跑通,极速推理会不会很快变成旗舰模型的标配。