Opus 5 反超 Fable 5,Anthropic 的定价牌局被打乱了?
Anthropic 发布 Claude Opus 5,定价仅为旗舰模型 Fable 5 的一半,但在编程、自主搜索、计算机使用和企业流程等多个基准测试中反超 Fable 5。尤其在 ARC-AGI 3 测试中,Opus 5 得分 30.2%,远超此前最强模型的 7.8%,展示了前所未有的流体智能。
SynthePulse Insight阅读深度解读AI 日报
2026-07-26
精选事件
6
来源
16
精选
6
更多
0
AI DAILY BRIEFING
Anthropic 发布 Claude Opus 5,定价仅为旗舰模型 Fable 5 的一半,但在编程、自主搜索、计算机使用和企业流程等多个基准测试中反超 Fable 5,尤其在 ARC-AGI 3 测试中得分 30.2%,远超此前最强模型的 7.8%。
Opus 5 以更低定价实现性能反超,可能迫使 Anthropic 重新审视定价策略,并加剧大模型价格竞争。
腾讯开源具身基座模型并提“三层脑”架构,新智触觉数据补齐手感,显示具身智能领域正从单一模型向分层、多模态融合方向发展。
DeepSeek 融资因泄密暂停,反映 AI 初创公司在高速扩张中面临的信息安全与治理挑战。
下一步关注:关注 Anthropic 是否会调整 Fable 5 定价或推出新旗舰;腾讯开源模型的实际应用效果;DeepSeek 融资后续进展及开源策略影响。
Anthropic 发布 Claude Opus 5,定价仅为旗舰模型 Fable 5 的一半,但在编程、自主搜索、计算机使用和企业流程等多个基准测试中反超 Fable 5。尤其在 ARC-AGI 3 测试中,Opus 5 得分 30.2%,远超此前最强模型的 7.8%,展示了前所未有的流体智能。
SynthePulse Insight阅读深度解读腾讯在WAIC 2026期间开源了三款具身基座模型,并提出了“三层脑”架构,将认知、感知和执行分层运行,以解决机器人响应延迟问题。首席科学家张正友强调,物理世界存在不同的时间尺度,分层架构是长期合理的方案。
SynthePulse Insight阅读深度解读新智具身与复旦大学联合发布了三份技术报告,旨在通过3万小时的触觉交互数据解决具身智能中触觉感知缺失的问题。团队提出了统一触觉表征模型NeoForce,以及两种技术路线:-VTLA通过预测未来触觉演变提升操作成功率,-TWAM将触觉融入世界模型,让机器人在执行前进行触觉想象推演。项目数据和模型将开源,有望推动具身智能在精细操作领域的进步。
SynthePulse Insight阅读深度解读Anthropic的Claude Opus 5在ARC-AGI-3基准测试中取得了30.2%的分数,几乎是GPT-5.6 Sol此前7.8%纪录的四倍。该基准测试的开发者表示,该模型独立推导出了反射方程,这是他们从未在其他模型中见过的行为,并归因于更强的逻辑推理能力。
SynthePulse Insight阅读深度解读Valkor联合浙江大学智能计算与软件研究中心和伦敦大学学院(UCL)软件工程团队,正式开源了Loom。Loom旨在解决AI编程Agent在长任务中出现的'局部失忆'问题,通过将复杂交付过程拆解为可恢复的结构化状态链,帮助Agent在测试失败或会话中断后保持上下文一致性,从而提升AI在真实工程中的可靠性。
SynthePulse Insight阅读深度解读DeepSeek创始人梁文锋因投资人会议纪要泄露而震怒,叫停新一轮融资签约,导致原本加速推进的710亿美元估值融资及IPO筹备工作暂停。泄露事件引发内部反思,梁文锋强调开源策略并认为开源不影响商业模式。
SynthePulse Insight阅读深度解读