Meta 发布首款 AI 编程智能体 Muse Code,模型能力直逼 Opus 5
Meta 正式推出其首款 AI 编码智能体 Muse Code,由 Muse Spark 1.2 模型驱动,可在终端中完成复杂软件工程任务。该模型在多个基准测试中表现强劲,仅次于 Opus 5。扎克伯格暗示未来可能开源,引发社区关注。
Meta 正式推出其首款 AI 编码智能体 Muse Code,由 Muse Spark 1.2 模型驱动,可在终端中完成复杂软件工程任务。该模型在多个基准测试中表现强劲,仅次于 Opus 5。扎克伯格暗示未来可能开源,引发社区关注。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
Meta 正式推出终端 AI 编程 Agent Muse Code,由 Muse Spark 1.2 驱动,在多个基准上仅弱于 Opus 5(max),并引发开源讨论。
Meta 于 2026 年 8 月 6 日正式发布 Muse Code 测试版,这是一款运行在终端中的 AI 编码 Agent,由 Muse Spark 1.2 模型驱动。扎克伯格表示,它能在大型代码仓库中完成复杂软件工程任务,包括分析项目、规划修改、编写代码、运行工具及验证结果。
Muse Code 采用简单的智能体循环,并配合一组异步后台智能体,这些后台智能体在整个会话期间持续运行,减少重复信息收集,可自主执行后续步骤并判断何时反馈结果,从而降低延迟并减少对人工引导的依赖。
产品发布后,网友询问开源问题,扎克伯格回应“很快将会有更多关于这一话题的内容要分享”,暗示未来可能开源。
运行时设计:Muse Code 使用本地事件日志,记录模型调用、工具运行、审批操作和代码修改,作为唯一可信数据源,支持精确重放和重启后安全恢复,即使崩溃也能从中断处继续执行,适合长时程任务。
内置技能:默认提供 /plan(将任务拆解为需审批的计划)、/grill(对计划反复压力测试)、/goal(围绕目标持续推进直至成功),增强任务执行的可靠性和自主性。
Muse Spark 1.2 是编程能力升级版本,重点提升代码生成、调试、代码库理解和端到端开发。在 Terminal-Bench 2.1 上仅弱于 Opus 5(max);在 DeepSWE 1.1 上不敌 Opus 5(max)和 GPT-5.6 Terra(max);在 Meta 内部基准上仅弱于 Opus 5(max)。
训练改进包括:与 Muse Code 协同训练,引入拒绝采样轨迹和工具集;针对长时程任务大规模训练,使用规划、目标约束和上下文压缩;通过自我改进机制,利用 Muse Spark 1.1 生成训练数据,提升指令遵循能力。
Muse Code 定价分普通版和 Contributor 版:普通版输入 1.25 美元/百万 Token,缓存输入 0.15 美元,输出 4.25 美元;Contributor 版输入 0.10 美元/百万 Token,缓存输入 0.002 美元,输出 0.20 美元。
Meta 此举标志着其与 OpenAI、Anthropic 在编码 Agent 赛道正面竞争,产品发布引发社区热议。
本文信息主要来自机器之心报道,属于二手来源,但引用了 Meta 官方博客和扎克伯格推文,基准数据为来源声称,未经独立验证。
Meta 通过 Muse Code 和 Muse Spark 1.2 强势进入编程 Agent 领域,模型性能接近顶尖水平,且开源可能性引发关注,未来竞争将更加激烈。
主报道
主报道来源