返回信息流
新闻事件
A重点81
机器之心
3 个来源

OpenAI联合Cerebras预览GPT-5.6 Sol超高速模式,速度提升14倍

OpenAI 与 AI 芯片厂商 Cerebras 联合预览了旗舰模型 GPT-5.6 Sol 的「超高速模式」,输出速度最高可达 750 tokens/s,相比标准模式提升 14 倍且不降低质量。该模式基于 Cerebras 的晶圆级硬件架构,率先在 OpenAI API 中推出,已面向部分客户提供有限预览。

SynthePulse Insight · AI 深度解读会员精读

GPT-5.6 Sol 超高速模式:14倍加速背后的架构革命与商业逻辑

版本 1 · 3 个来源

OpenAI 联合 Cerebras 推出 GPT-5.6 Sol 的 Ultrafast 模式,输出速度最高达 750 tokens/s,较标准模式提升 14 倍。这一突破不仅依赖晶圆级芯片的片上存储,更揭示了 AI 推理速度作为独立商业维度的新趋势。

  • OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式,输出速度最高 750 tokens/s,较标准模式提升 14 倍,且质量不降。
  • 该模式由 Cerebras 晶圆级芯片 WSE-3 驱动,其 44 GB 片上 SRAM 使模型参数常驻,避免内存带宽瓶颈。
  • 在 HLE 基准上,Ultrafast 模式 11 小时 11 分完成全部题目,而 Claude Fable 5 需 78 小时 27 分,速度约为后者的 7 倍。
展开章节目录14倍加速:数字背后的性能跃升

14倍加速:数字背后的性能跃升

8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast Mode)。在该模式下,输出速度最高可达 750 tokens/s,相比 Standard 模式约 53 tokens/s 的推理基线,速度提升最高达 14 倍,且不降低任何质量。横向对比,GPT-5.6 Sol 加速后比 Fable 5 快 11 倍,比 Opus 4.8 在 Fast 模式下快 5 倍。

在 Cerebras 的博客中,工程人员介绍了在「人类最后的考试」(Humanity's Last Exam, HLE)上的测试。HLE 包含 2500 道题,通常只有博士才能解答。GPT-5.6 Sol 在超快模式下仅用 11 小时 11 分钟就回答了全部问题,而 Claude Fable 5 则需要 78 小时 27 分钟,速度约为后者的 7 倍,准确率相近。在 GDP-Val 基准上,Ultrafast 实现了 5.6 倍的端到端速度提升,且质量未受影响。

这些数字表明,Ultrafast 模式不仅提升了吞吐量,还显著缩短了复杂任务的完成时间,为实时交互式工作流创造了条件。

限时免费

继续阅读完整分析

还有 4 节深入分析和完整结论

加载中

可信度边界

本文信息主要来源于机器之心、THE DECODER 和 TechCrunch 的报道,以及 OpenAI 和 Cerebras 的官方博客。所有性能数据(如 750 tokens/s、14 倍加速、HLE 用时等)均来自官方发布或媒体报道,但尚未经独立第三方验证。Cerebras 的硬件规格(4 万亿晶体管、125 petaflops、44 GB SRAM)来自其官方博客。关于定价和合作伙伴关系的细节来自 THE DECODER 的报道,属于二手信息。