8月13日,OpenAI发布全新“Ultrafast”(超快)运行模式,显著提升其最新旗舰大模型 GPT-5.6Sol 的处理效率。官方数据显示,在保持模型原有高水平智能与输出质量的前提下,Ultrafast 模式的运行速度较标准处理提升高达14倍,每秒可生成最多750个输出标记(Tokens)。

OpenAI联合Cerebras推出Ultrafast模式,GPT-5.6Sol提速14倍

该功能由 OpenAI 联合芯片厂商 Cerebras 共同开发,目前处于预览阶段,优先向部分企业客户开放,后续将随算力扩容逐步扩大覆盖范围。

传统大模型应用长期受制于“模型能力”与“响应速度”的妥协,实时场景往往被迫选用小参数模型。Ultrafast 模式的落地打破了这一困局,使 GPT-5.6Sol 能无缝部署于事件响应、客户服务、金融市场分析及电子商务等对时延极度敏感的复杂工作流中。

相较竞争对手 Anthropic 旗下的 Claude 快速模式,OpenAI 在输出吞吐量与执行效率上展现出更强优势。这一技术突破标志着前沿大模型正在加速从“高延迟离线推理”迈向“高吞吐实时交互”,未来将重塑企业级 AI 的落地形态与生产力标准。