跳至主要内容
OpenAI

2026年8月13日

产品

Ultrafast 模式预览:GPT‑5.6 Sol 速度最高提升至 14 倍

为前沿智能开创全新速度等级,将速度转化为竞争优势。

正在加载…

今天,我们将抢先展示 Ultrafast。这是一种新的服务层级,可让 GPT‑5.6 Sol 的运行速度比标准处理最高快 14 倍,并率先在 OpenAI API 中推出。Ultrafast 由 Cerebras 提供支持,每秒最多可生成 750 个输出 token,让我们最智能的模型能够用于分秒必争的产品和工作流。

借助 GPT‑5.6,我们正在拓展模型能力的前沿,并在整个技术栈的各个层面提高模型效率。这些改进让先进智能变得更实惠,也能惠及更多人、发挥更大作用。此前,要获得实时响应速度,通常意味着必须选择更小或更专业的模型。Ultrafast 展现了一条新的进步方向:每秒完成更多有价值的工作。

当速度不再以牺牲智能为代价,AI 就能深入企业中对时效要求最高的环节,并催生全新的工作方式。我们已经看到 Ultrafast 在一些场景中展现出令人振奋的潜力:

  • 事件响应与可靠性:当关键系统发生故障时,在中断仍在持续的情况下分析应用日志、近期代码变更和工程师报告,找出可能的原因并协助准备修复方案。
  • 金融研究与安全:在市场状况仍不断变化时分析市场信号、评估交易并识别可疑活动。
  • 客户支持与语音:即使寻找答案需要经过多个步骤或系统,也能在不中断对话的情况下实时解决复杂的客户问题。
  • 商业:在购物者仍在考虑时回答产品问题、查询库存、提供个性化推荐并解决结账问题,避免犹豫最终导致弃购。
  • 实时研究与实验:将以往需要整夜运行的研究转变为交互式工作会话,让团队能够连续验证想法、查看结果、调整方法并开展下一轮实验,而不会打断工作节奏。

预览期间,我们正与首批客户合作,了解这种速度在哪些方面影响最大,以及如何让这些经验逐步指导我们的产品发展。如果您的企业需要最高速度的前沿智能,可以注册,以便在开放更多访问名额时收到通知

GPT‑5.6 Sol 分别以 Ultrafast 和标准模式,根据同一文本提示并排构建可运行的 3D 仓库模拟器。

早期客户的使用体验

我们一直在与首批企业共同测试 Ultrafast 模式下的 GPT‑5.6 Sol,覆盖编程、商业、金融研究、支持及其他交互式应用。从业务工作流入手,有助于我们在真实生产环境中研究这些应用条件。他们的早期实践正在帮助我们了解,速度实现数量级提升时,哪些领域能够创造最大价值;当模型可以跟上使用者的节奏时,产品又会发生怎样的变化。随着容量增长,我们将依据这些发现指导部署。

1 条/ 共 4 条
Cerebras 带来的速度提升令人印象深刻。它带来了不同的模型使用方式,也让开发者能够切实可行地与模型协作,更专注、更高效地工作。
—John Crepezzi,Jane Street AI 助手团队

OpenAI 如何使用 Ultrafast

在 OpenAI 内部,一组开发者一直在测试 Ultrafast 模式下的 GPT‑5.6 Sol,以了解哪些工作流能从可实时回答的前沿智能中受益。

事件响应就是我们团队使用 Ultrafast 的一个场景。警报触发后,工程师需要在系统状态和证据仍不断变化时,准确掌握整体情况。团队利用它快速读取日志、分析跟踪数据、汇总对话、确定下一步检查事项,并协助准备或验证修复方案——借助 Sol 的智能,所需时间大幅缩短。它缩短了从观察信号、验证假设到决定下一步行动的时间,同时仍由工程师负责判断和部署。

在研究方面,我们的团队使用 Ultrafast 快速搜索知识来源、查询数据,并通过互联工具迅速收集、整理和总结信息。我们团队常见的研究工作流是夜间批量启动实验,第二天早上再查看结果。借助 Ultrafast,我们看到这一循环显著缩短,能够在一个工作日内完成多轮迭代。

由 Cerebras 提供支持

Ultrafast 标志着我们与 Cerebras 的合作迈入下一阶段,旨在为 OpenAI 平台带来超低延迟推理。如今,借助 Ultrafast 模式下的 GPT‑5.6 Sol,Cerebras 正在为 OpenAI 最智能的模型提供支持,每秒最多生成 750 个输出 token,帮助企业打造响应更快的产品、加快决策,并将强大的 AI 直接融入要求最高的工作流。

可用情况

Ultrafast 模式下的 GPT‑5.6 Sol 现已面向部分精选客户提供限量预览。随着容量增长,我们将开放更多访问名额。注册以获取最新动态

作者

OpenAI