返回信息流
新闻事件
A重点78
OpenAI Developers (X)
3 个来源

GPT-5.6 推出三个模型层级

OpenAI 发布 GPT-5.6,包含三个模型层级:Sol 用于复杂代理任务,Terra 用于日常工作,Luna 用于高速任务。Terra 在更低成本下超越 GPT-5.5,Luna 以不到一半的 API 成本接近 GPT-5.5 峰值性能。

SynthePulse Insight · AI 深度解读

GPT-5.6 三档分层:OpenAI 的性价比攻势与安全牌

版本 1 · 3 个来源

OpenAI 发布 GPT-5.6 系列,以 Sol、Terra、Luna 三档模型覆盖从高难度编程到日常办公的不同场景,主打“每 token 更多智能”和“更强性能每美元”。在宣称超越 Anthropic 的同时,也首次将网络安全作为核心卖点。

  • GPT-5.6 分为三档:Sol(旗舰)、Terra(均衡)、Luna(高速低价),分别面向长周期编程与智能体任务、日常办公、高吞吐标准化工作。
  • OpenAI 称 Sol 在 Coding Agent Index 上以 80 分超越 Anthropic Fable 5(77.2 分),且输出 token 减半、时间减半、成本低约三分之一。
  • Terra 在知识工作评估中超越 GPT-5.5 且成本更低;Luna 性能接近 GPT-5.5,API 成本不到一半。
  • CEO Sam Altman 称 Sol 在 AI 编程任务中 token 效率提升 54%。
  • GPT-5.6 被定位为“最强网络安全模型”,支持威胁建模、代码审查、蓝队演练等防御任务。
  • 定价:Sol 输入 $5/百万 token、输出 $30;Terra $2.5/$15;Luna $1/$6。
展开章节目录三档分层:从旗舰到经济型的全覆盖

三档分层:从旗舰到经济型的全覆盖

OpenAI 于 2026 年 7 月 9 日发布 GPT-5.6 系列,首次采用三档模型策略。Sol 定位为“工作马”,专攻需要规划、工具使用和持续跟进的长周期编程与智能体任务;Terra 平衡性能与成本,面向日常办公;Luna 则针对定义明确、高吞吐量的工作场景,强调速度。

这一分层策略直接对标不同用户群体的预算与需求。OpenAI 宣称,在知识工作评估中,Terra 以低于 GPT-5.5 的成本实现超越,而 Luna 以不到 GPT-5.5 一半的 API 成本接近其峰值性能。

性能对标:直指 Anthropic 的基准战

OpenAI 明确将 GPT-5.6 与 Anthropic 的模型进行对比。引用 Artificial Analysis Coding Agent Index,OpenAI 声称 Sol 以 80 分创下新纪录,比 Anthropic Fable 5 的 77.2 分高出 2.8 分,同时输出 token 不到一半、耗时不到一半、成本低约三分之一。

这一优势延伸至全系列:Terra 性能略高于 Fable 5,Luna 则超越 Opus 4.8。CEO Sam Altman 此前向 CNBC 透露,Sol 在 AI 编程任务中 token 效率提升 54%。

网络安全:从争议到核心卖点

GPT-5.6 被 OpenAI 称为“最强网络安全模型”,声称以显著更少的 token 实现前沿性能。其安全能力覆盖威胁建模、代码审查与补丁、蓝队演练等防御性任务。值得注意的是,特朗普政府此前曾因担忧模型被滥用而试图限制其发布。

这一安全定位既是技术亮点,也是应对监管压力的策略。OpenAI 强调模型支持防御活动,而非攻击用途,试图在能力展示与责任边界之间取得平衡。

生态扩展:ChatGPT Work 与 Codex 硬件

伴随模型发布,OpenAI 推出了 ChatGPT Work——一款面向企业团队的桌面、网页和移动端工作助手,可协助起草文档、电子表格和演示文稿。此外,OpenAI 还发布了一款售价 230 美元的 Codex 键盘,进一步强化编程场景的硬件生态。

这些举措表明 OpenAI 正从纯模型提供商向企业生产力平台转型,与 Anthropic 在企业市场的竞争进一步白热化。

可信度边界

本文主要依赖 OpenAI 官方博客、OpenAI 开发者 X 账号及 TechCrunch 报道。性能对比数据(如 Coding Agent Index 分数、成本节省比例)均来自 OpenAI 单方面声明,未经独立验证。CEO 关于 token 效率的表述源自 CNBC 采访转述。

核心结论

GPT-5.6 通过三档分层和激进定价,在性能与成本之间提供了明确选择,同时以网络安全为差异化卖点。其宣称的对 Anthropic 的全面优势仍需第三方基准检验,但分层策略本身已为行业树立了新的产品形态标杆。

主报道

OpenAI Developers (X)

主报道来源

同一事件报道

另有 2 个来源报道