8月13日,OpenAI 宣布预览 Ultrafast 服务层级。该模式将 GPT-5.6 Sol 的处理速度提升至标准处理的最高14倍,并首先在 OpenAI API 中向部分客户开放预览。
OpenAI 表示,这项服务由 Cerebras 提供支持,目标是在保持高阶模型能力的同时降低推理延迟。Ultrafast 最高可生成每秒 750 个输出 token,并首先在 OpenAI API 中面向部分客户预览。
官方列出的适用场景包括故障响应、金融研究与安全、客服和语音交互、商业咨询以及实时研究与实验。对于这类任务,速度提升的价值不只在于更快给出单次答案,也在于缩短“观察信号—验证假设—采取下一步行动”的迭代时间。
目前该能力仍是有限预览。OpenAI 称,正在与一组来自编程、商业、金融研究和客服等领域的客户测试,后续会随容量增长扩大访问范围。文章中的速度数据与应用案例均来自发布方说明,实际表现还会受模型请求、系统架构和使用环境影响。
随着模型能力趋于成熟,企业级 AI 的竞争也正延伸到延迟和吞吐等工程指标。对于需要实时交互的工作流,模型是否能在足够短的时间内完成多步骤处理,将直接影响其产品形态与可用边界。
来源:OpenAI 于2026年8月13日发布的 Ultrafast 产品预览公告。本文为中文编译与整理。
您必须登录或注册以后才能发表评论