OpenAI 宣布下一代模型 Astra,并发布十个此前未解的数学难题
OpenAI 宣布了其下一代模型系列“Astra”,该系列允许多个智能体协同工作数小时甚至数天以解决复杂问题。CEO Sam Altman 已向华盛顿的政策制定者演示了 Astra,但尚未决定将其作为 GPT-6 还是 GPT-5 的变体发布。
OpenAI 宣布了其下一代模型系列“Astra”,该系列允许多个智能体协同工作数小时甚至数天以解决复杂问题。CEO Sam Altman 已向华盛顿的政策制定者演示了 Astra,但尚未决定将其作为 GPT-6 还是 GPT-5 的变体发布。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
OpenAI通过发布解决十个长期未解数学难题的报告,首次正式确认了其“下一代大模型家族”Astra。这一举动展示了AI在科学推理上的潜力,但模型仍需通过美国政府的审查,且多智能体系统的可靠性问题尚未解决。
OpenAI于2026年8月1日发布了一份数学报告,首次正式确认了Astra的名称,称其为“下一代大模型家族”。报告称,Astra的内部版本解决了数学和理论计算机科学中的十个开放问题,这些问题数学家至少十年未取得进展,多数甚至更久。
这些成果涵盖高维几何、编码理论、群论、量子复杂性、格密码学和极值组合学等领域。其中一个证明建立了非sofic群的存在性,解决了群论中的一个重大开放问题。
曼彻斯特大学的数学家Thomas Bloom在X上称这些结果是“大新闻”,认为其意义超过了五月份发表的单位距离猜想反例。但他也反驳了AI取代数学家的说法,指出AI基于一个多世纪的数学理论,由数学家构建,并训练了数学家写过的所有内容。
OpenAI表示,生成所有十个解决方案所用的token按Sol的API费率计算约需2000美元。模型生成论证后,人类与同一模型合作将其转化为研究论文,并使用Lean对每个证明进行了形式化,生成机器可检查的数学正确性证书。
OpenAI还发布了每个解决方案的推理过程演示。公司表示,研究人员帮助准备了论文并形式化了证明,公司对其准确性负责,但数学论证本身来自Astra。
OpenAI认为,将完全由AI生成的证明归功于人类会歪曲系统的贡献和真正的人类智力工作,并引用了《莱顿AI与数学宣言》作为AI辅助研究中功劳分配的参考。
据The Information报道,Astra模型已在测试中,预计将成为首个接受特朗普政府计划的新AI框架审查的模型,该框架要求AI模型在公开发布前提交给联邦政府。政府目标是在本周末前敲定该框架。
OpenAI尚未决定Astra是作为GPT-6还是GPT-5的变体(如GPT 5.7)发布,也没有发布日期。CEO Sam Altman已在华盛顿向政策制定者演示了Astra。
一个关键问题是模型能否在长时间运行的工作流中避免错误累积,并在上下文增长时自我纠正。这仍是当前智能体系统的主要弱点。多智能体设置如Astra在紧密耦合任务(如规划)上可能表现更差,因为协调开销和错误累积可能抵消收益。
OpenAI的长期目标是构建能够连续工作数小时甚至数天的AI系统。首席科学家Jakub Pachocki在去年夏天的播客中表示,公司希望模型能在更长时间范围内规划、推理和实验。OpenAI还计划到2028年3月拥有完全自主的AI研究员,并最早在今年9月拥有研究实习生级别的AI系统。
本文信息主要来自THE DECODER的报道,其中部分细节(如Astra的测试状态和监管计划)源自The Information的报道,属于二手来源,其准确性未经独立验证。OpenAI的数学报告是官方发布,但其中关于数学问题解决的说法尚未经过同行评审。
Astra的发布标志着OpenAI在科学推理和长时间任务处理上的重大进展,但监管审查、技术可靠性和发布形式的不确定性意味着其实际影响仍有待观察。
主报道
主报道来源