返回信息流
新闻事件
A重点74
OpenAI Blog
1 个来源

OpenAI 预览 Ultrafast 模式:GPT-5.6 Sol 速度提升高达 14 倍

OpenAI 预览了新的 API 服务层级 Ultrafast,该层级由 Cerebras 提供支持,可将 GPT-5.6 Sol 的运行速度提升至原来的 14 倍,输出速度高达每秒 750 个 token。这一新服务层级旨在为开发者提供更快的 AI 推理能力,可能对依赖实时响应的应用产生重要影响。

SynthePulse Insight · AI 深度解读

OpenAI 预览 Ultrafast:GPT-5.6 Sol 提速 14 倍,背后是 Cerebras 硬件

版本 1 · 1 个来源

OpenAI 于 2026 年 8 月 13 日发布预览公告,推出名为 Ultrafast 的 API 服务层级,宣称可将 GPT-5.6 Sol 的推理速度提升至 14 倍,输出速率高达每秒 750 tokens。该服务由 Cerebras 提供算力支持。

  • OpenAI 预览 Ultrafast,一个全新的 API 服务层级,专为 GPT-5.6 Sol 设计。
  • Ultrafast 宣称提供高达 14 倍的速度提升,以及每秒 750 个输出 tokens 的速率。
  • 该服务由 Cerebras 提供硬件支持,但具体技术细节尚未披露。
  • 目前仅为预览阶段,正式上线时间和定价未公布。
展开章节目录公告核心:速度与硬件

公告核心:速度与硬件

OpenAI 于 2026 年 8 月 13 日通过官方博客发布预览公告,推出名为 Ultrafast 的新 API 服务层级。该服务专为 GPT-5.6 Sol 模型设计,宣称可将其运行速度提升至 14 倍,输出速率达到每秒 750 个 tokens。

公告明确表示,Ultrafast 由 Cerebras 提供算力支持。Cerebras 是一家以制造大型晶圆级芯片而闻名的公司,但公告未透露具体硬件配置或优化技术。

性能指标解读

14 倍的速度提升和每秒 750 个输出 tokens 是公告中的核心数字。这些指标可能基于特定测试条件,但公告未提供基准测试细节或对比基线。

值得注意的是,这些数字来自 OpenAI 的官方公告,属于公司自我声明,尚未有独立验证。

服务层级与可用性

Ultrafast 被描述为“API 服务层级”,暗示其可能作为独立于标准 API 的付费选项,但公告未提及定价、正式发布日期或地区可用性。

目前该服务处于预览阶段,开发者可能通过申请或邀请制获得访问权限,但公告未明确说明。

行业背景与潜在影响

此次发布正值 AI 推理速度竞争加剧之际。OpenAI 与 Cerebras 的合作可能旨在满足对低延迟、高吞吐量推理的需求,尤其是在实时应用场景中。

然而,公告未提及任何客户案例或实际部署情况,因此其实际性能表现仍需观察。

可信度边界

本报道基于 OpenAI 官方博客的单一来源。所有性能数字和合作信息均来自该公告,属于公司自我声明,未经独立验证。

核心结论

OpenAI 预览 Ultrafast 服务,宣称 GPT-5.6 Sol 推理速度提升 14 倍,输出速率达每秒 750 tokens,由 Cerebras 提供算力。但该公告缺乏技术细节和独立验证,实际性能与可用性尚待观察。

主报道

OpenAI Blog

主报道来源