原力灵机发布具身基础模型DM0.5,推动规模化落地
原力灵机发布了具身基础模型DM0.5,该模型支持在消费级显卡上微调,训练成本降低60%,并在多个基准测试和真机评测中取得领先成绩。DM0.5采用4B参数,基于15万小时数据训练,通过架构创新和推理加速,旨在推动具身智能的规模化落地。
AI 日报
2026-08-07
精选事件
25
来源
12
精选
12
更多
13
AI DAILY BRIEFING
具身智能与AI安全成为焦点,原力灵机发布DM0.5模型推动规模化落地,Anthropic则通过安全隔离架构和生物安全措施增强Claude的可靠性。
具身智能模型DM0.5降低训练成本,有望加速行业应用。
Anthropic的安全架构改进凸显AI安全从依赖用户确认转向基础设施约束。
谷歌核心科学家离职或影响其AI战略,但开源社区持续推动AI自我改进。
下一步关注:关注谷歌AI重组后续动态,以及DM0.5在真实场景中的表现。
原力灵机发布了具身基础模型DM0.5,该模型支持在消费级显卡上微调,训练成本降低60%,并在多个基准测试和真机评测中取得领先成绩。DM0.5采用4B参数,基于15万小时数据训练,通过架构创新和推理加速,旨在推动具身智能的规模化落地。
Anthropic正在更新Claude Fable 5的生物安全防护措施,以大幅减少回退情况。这些更改旨在通过减少不必要的安全回退来提高模型性能。
SynthePulse Insight阅读深度解读北卡罗来纳大学教堂山分校和斯坦福大学的研究团队提出了Handroid,一款高0.33米、重2.05千克、拥有27个自由度的可重构桌面级机器人。它能在小型人形机器人和多指灵巧手两种形态之间切换,旨在打破移动与精细操作之间的边界。该研究展示了形态复用设计思路,即同一套硬件通过重组承担不同功能,为机器人设计提供了新方向。
SynthePulse Insight阅读深度解读Anthropic 近日发布文章,详细介绍了 Claude 在 Web、开发者和桌面产品中的安全隔离架构,强调通过文件系统、网络和执行环境等基础设施建立确定性安全边界。文章披露了多个安全事件,包括 Claude Code 在用户确认前解析本地配置、红队测试中 24/25 次数据外传成功,以及通过 Files API 的漏洞,并说明了相应的设计调整。这些措施旨在降低依赖用户确认或模型自身机制的风险,提升 Agent 的安全性。
SynthePulse Insight阅读深度解读谷歌在24小时内失去四位核心AI科学家,包括首席科学家Jeff Dean,同时DeepMind CEO Demis Hassabis卸任日常运营职务。此次人事变动发生在旗舰模型Gemini 3.5 Pro跳票、自由现金流转负和人才流失加剧的背景下,被视为谷歌AI战略的重大重组。
SynthePulse Insight阅读深度解读作者分享了在重构一个历史包袱沉重的项目时,通过搭建AI上下文工程,使AI从最初频繁出错到能够高效定位问题、提供贴合项目需求的解决方案的经验。文章强调了上下文信息对AI协作的重要性,并提出了将重构过程转化为AI可维护项目的方法。
SynthePulse Insight阅读深度解读谷歌首席科学家Jeff Dean离职创业,成立Discovery Loop,专注AI自动研究与递归自我改进。同时,衔远科技与清华大学团队开源了35B参数的AI4AI模型Frontis-MA1及OpenMLE套件,在MLE-Bench Lite上取得71.21%的成绩,推动AI自我改进研究。
Rust 项目针对 rust-lang/rust 主仓库采纳了 LLM 使用政策,规定 AI 生成内容必须披露,且涉及 soundness 的关键改动限制严格。政策旨在应对 AI 编程导致 PR 质量信号失真、维护者审核负担加重的问题,同时保留 LLM 在辅助分析、翻译等场景的用途。
SynthePulse Insight阅读深度解读Prime Intellect 发布了开源智能体框架 Prime Agent,声称在 ARC-AGI-3 基准上联合 Opus 5 取得了 95.5% 的成绩,超过人类专家基线。该框架基于递归语言模型(RLM)理念,通过持久 IPython 内核和可动态修改的 harness 设计,使模型能够自我改进并适应陌生任务。这一成果引发了关于 AI 自我改进能力的讨论。
SynthePulse Insight阅读深度解读OpenAI更新了ChatGPT,为免费用户和付费用户分别推出GPT-5.6 Luna和GPT-5.6 Sol模型,并新增思考强度滑块。免费用户获得无限文本对话权限,但仍有使用限制。新模型在事实准确性上有所提升,内部评估显示错误率显著下降。
SynthePulse Insight阅读深度解读OpenAI 今日更新 ChatGPT,付费侧对 GPT-5.6 Sol 进行调优并新增思考程度滑杆,免费侧默认模型改为 GPT-5.6 Luna,文本对话不再限量,并新增 Think 按钮。此次更新旨在提升事实准确性,并降低推理成本,使免费无限量对话成为可能。
SynthePulse Insight阅读深度解读OpenAI更新了ChatGPT,为免费用户和付费用户分别推出GPT-5.6 Luna和GPT-5.6 Sol,并新增思考强度滑块。新模型在事实可靠性上有所提升,免费用户获得无限文本对话权限,但仍有使用限制。
SynthePulse Insight阅读深度解读Artificial Analysis 更新了其文本到图像竞技场,扩展了评估范围,涵盖更多用例和能力,并发布了新的排行榜。更新后的评估旨在帮助用户根据特定工作需求选择模型,并提供了对顶级模型的初步分析。
SynthePulse Insight阅读深度解读由上海交大、深势科技和上海算法创新研究院组成的无尽前沿团队发布了BigBang-V1,这是首个基于递归自我改进(RSI)原生方式训练的基座模型。该模型在训练中完全由AI自主出题、解题和验证,无需人类逐题参与,在多项评测中超越更大规模的模型。
SynthePulse Insight阅读深度解读OpenAI 宣布取消所有 ChatGPT 用户的文本聊天限制,并推出新的 GPT-5.6 Luna 和 Sol 模型,分别面向免费/Go 用户和 Plus/Pro 用户,同时引入“思考”按钮和推理深度滑块。此外,有报道披露了 OpenAI 与 Jony Ive 合作开发的首款硬件设备——一款无屏幕的甜甜圈形 AI 音箱,预计售价 300-400 美元,可能于 2027 年发布。
SynthePulse Insight阅读深度解读上海交通大学等机构的研究团队发布了科研大模型BigBang-V1,该模型基于Qwen3.6-35B-A3B进行后训练,使用完全由AI合成的数据,在多项评测中达到35B规模最佳,甚至超越部分更大模型。其核心创新在于让AI参与创建、筛选和迭代自己的训练任务,实现自我进化,标志着AI开始参与决定下一代模型的学习内容。
SynthePulse Insight阅读深度解读腾讯多模态 RL Infra 负责人朱文熙将在 AICon 深圳站分享 UniRL 框架的 2.4X 端到端性能优化实践。该框架针对 Diffusion RL 与 LLM RL 的 Infra 差异,通过架构设计、自研算子、训推一致性和异步引擎等全链路工程实践,解决了训练稳定性与性能问题。
Meta 宣布其 AI 模型在五项 STEM 学科奥林匹克竞赛中取得金牌或金牌水平成绩,其中两项物理竞赛理论考试满分,且全程禁用工具以测试纯推理能力。该模型是 Muse Spark 系列的内部版本,使用了多智能体编排与并行推理。此举被视为 Meta 在大模型竞赛中重新崛起的信号。
SynthePulse Insight阅读深度解读亚马逊、Cursor、微软、OpenAI 和 Vercel 联合创建了 Agent Plugins,这是一个开放标准,定义了 AI 代理扩展的统一包格式。1.0.0 版本使用 plugin.json 清单文件,并支持代理技能和 MCP 服务器。该标准旨在促进 AI 代理生态系统的互操作性。
SynthePulse Insight阅读深度解读宇树科技科创板IPO发行价定为150.80元/股,发行总市值609.9亿元,发行市盈率219.23倍,远超市场预估。这一定价终结了具身智能赛道估值悬念,为行业建立了基于公开数据的定价坐标系,推动估值从故事驱动转向数据驱动。
SynthePulse Insight阅读深度解读OpenAI 发布了 GPT-5.6 模型更新,默认模型升级为 GPT-5.6 Luna,并推出更直接、精简的对话风格(GPT-5.6 Sol)。新模型在事实准确度上大幅提升,错误率比 GPT-5.5 减少 68%,同时新增思考深度调节滑块和 Think 按钮,并强化了未成年人安全保护措施。
SynthePulse Insight阅读深度解读本文分析指出,随着大模型进入长上下文和复杂推理阶段,KV Cache等推理状态成为AI基础设施中的一级资源,存储开始进入Token生成的实时主链路。月之暗面的Mooncake和NVIDIA的CMX代表了这一趋势,它们分别从软件架构和硬件层面将存储纳入推理数据路径,以提升GPU利用率和系统吞吐。
DeepSeek宣布API价格将大幅上涨,官方解释称并非为了多赚钱,而是因为模型使用量激增导致算力紧张。公司正在建设数据中心并筹备融资以应对需求,同时建议用户考虑其他套餐。
SynthePulse Insight阅读深度解读openJiuwen开源AI Agent平台发布了企业级分布式蜂群架构,将蜂群能力扩展到企业级分布式集群,并内置算力亲和能力以降低规模化运行成本。中国邮政储蓄银行基于该架构构建了金融领域蜂群智能体平台,并成功落地生产环境,这是分布式蜂群架构首次在企业级生产环境落地,标志着企业Agent规模化应用迈出重要一步。
SynthePulse Insight阅读深度解读开源 GPU 虚拟化项目 HAMi 于 7 月 2 日通过 CNCF 技术监督委员会评审,正式进入孵化阶段。该项目已被数百家企业采用,旨在提高 GPU 利用率。创始人表示,进入孵化阶段后,他们仍需面对社区治理和商业化的挑战。
SynthePulse Insight阅读深度解读