OpenAI 预览 Ultrafast 模式:GPT-5.6 Sol 速度提升高达 14 倍
OpenAI 预览了新的 API 服务层级 Ultrafast,该层级由 Cerebras 提供支持,可将 GPT-5.6 Sol 的运行速度提升至原来的 14 倍,输出速度高达每秒 750 个 token。这一新服务层级旨在为开发者提供更快的 AI 推理能力,可能对依赖实时响应的应用产生重要影响。
OpenAI 预览了新的 API 服务层级 Ultrafast,该层级由 Cerebras 提供支持,可将 GPT-5.6 Sol 的运行速度提升至原来的 14 倍,输出速度高达每秒 750 个 token。这一新服务层级旨在为开发者提供更快的 AI 推理能力,可能对依赖实时响应的应用产生重要影响。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
OpenAI 于 2026 年 8 月 13 日发布预览公告,推出名为 Ultrafast 的 API 服务层级,宣称可将 GPT-5.6 Sol 的推理速度提升至 14 倍,输出速率高达每秒 750 tokens。该服务由 Cerebras 提供算力支持。
OpenAI 于 2026 年 8 月 13 日通过官方博客发布预览公告,推出名为 Ultrafast 的新 API 服务层级。该服务专为 GPT-5.6 Sol 模型设计,宣称可将其运行速度提升至 14 倍,输出速率达到每秒 750 个 tokens。
公告明确表示,Ultrafast 由 Cerebras 提供算力支持。Cerebras 是一家以制造大型晶圆级芯片而闻名的公司,但公告未透露具体硬件配置或优化技术。
14 倍的速度提升和每秒 750 个输出 tokens 是公告中的核心数字。这些指标可能基于特定测试条件,但公告未提供基准测试细节或对比基线。
值得注意的是,这些数字来自 OpenAI 的官方公告,属于公司自我声明,尚未有独立验证。
Ultrafast 被描述为“API 服务层级”,暗示其可能作为独立于标准 API 的付费选项,但公告未提及定价、正式发布日期或地区可用性。
目前该服务处于预览阶段,开发者可能通过申请或邀请制获得访问权限,但公告未明确说明。
此次发布正值 AI 推理速度竞争加剧之际。OpenAI 与 Cerebras 的合作可能旨在满足对低延迟、高吞吐量推理的需求,尤其是在实时应用场景中。
然而,公告未提及任何客户案例或实际部署情况,因此其实际性能表现仍需观察。
本报道基于 OpenAI 官方博客的单一来源。所有性能数字和合作信息均来自该公告,属于公司自我声明,未经独立验证。
OpenAI 预览 Ultrafast 服务,宣称 GPT-5.6 Sol 推理速度提升 14 倍,输出速率达每秒 750 tokens,由 Cerebras 提供算力。但该公告缺乏技术细节和独立验证,实际性能与可用性尚待观察。
主报道
主报道来源