AI 日报

2026-08-11

AI行业动态:NVIDIA发布新模型与电源架构,Anthropic引入水印,Meta拥抱开源

AI DAILY BRIEFING

NVIDIA在AI基础设施和模型方面双线推进,发布800 VDC电源架构和Nemotron 3.5 Lightning模型,同时Anthropic为合规引入水印,Meta重新拥抱开源,显示行业在性能、合规和开放性上的多重博弈。

NVIDIA通过电源架构创新和高效模型发布,持续巩固其在AI基础设施和推理性能上的领先地位。

Anthropic的水印技术是AI合规的重要一步,但可能引发对模型透明度和隐私的进一步讨论。

Meta开源Muse Glimmer表明开源路线仍是重要战略,但性能差距可能影响其竞争力。

下一步关注:关注NVIDIA 800V电源架构的实际部署效果,以及Anthropic水印技术的实施细节和行业反应。

精选

S信号87
NVIDIA AI Blog

扩展AI计算性能需要新的电源架构

NVIDIA、谷歌和微软正合作开发一种新的800 VDC电源架构,旨在提高AI数据中心的效率和可扩展性。他们已发布相关规范,并与80多家制造商合作生产兼容产品。NVIDIA计划在2026年下半年推出800 VDC电源机架,以实现混合AC/DC设施。

A重点81
NVIDIA AI (X)

NVIDIA 发布 Nemotron 3.5 Lightning:开放 30B MoE 模型

NVIDIA 发布了 Nemotron 3.5 Lightning,一个开放的 30B MoE 模型,具有 3B 激活参数,专为高容量、专业化任务设计,输出速度比同类模型快 4 倍。同时,NVIDIA 还发布了 NeMo Switchyard,一个用于模型路由的开源库,以优化代理工作流。该模型权重、数据和配方已在 Hugging Face 上开放。

S信号86
The AI Insider

Anthropic 将为 Claude 产品添加 AI 生成文本水印以符合欧盟规则

Anthropic 宣布将对其 AI 模型(包括 Claude)生成的文本添加水印,以遵守欧盟《人工智能法案》的透明度规范。该规范自 8 月 2 日起生效,要求 AI 公司以可被其他系统检测的方式标记 AI 生成的内容。Anthropic 表示,8 月 2 日之后发布的所有模型将自动包含水印技术,并支持 C2PA 开放标准。

S信号86
机器之心

RefCaptioner:让参考图与视频语义精准对应

北京大学与可灵团队提出RefCaptioner,通过后训练强化模型对参考图的识别与绑定能力,并构建结构化视频描述,解决多参考图场景下视频理解模型对应能力下降的问题。该方法采用混合数据SFT和双层自适应奖励函数HCD-GRPO,提升参考图与视频语义的精准对应。

S信号87
THE DECODER

研究人员在ChatGPT隐藏推理中发现漏洞和泄露的密码

安全研究人员在OpenAI、Anthropic和Google的API中发现了一个漏洞,该漏洞允许他们提取加密的推理痕迹并在模型之间移动。对公共会话的扫描发现了数十个密码和API密钥,表明用户的敏感信息可能被泄露。此外,推理摘要往往隐藏了模型实际执行的操作,引发了隐私和透明度的担忧。

S信号86
The AI Insider

Dyna Robotics 推出基于百万小时人类视频训练的世界动作模型

Dyna Robotics 发布了 Dyna-2,这是一个基于超过一百万小时第一人称人类视频训练的机器人基础模型,旨在通过观察人类活动来学习物理世界的变化。该公司声称,该模型在机器人性能上表现出可预测的扩展规律,并有望加速商用自动化的发展。

S信号86
量子位

蚂蚁首次投资触觉感知层,领投戴盟机器人数亿元战略轮融资

戴盟机器人宣布完成数亿元战略轮融资,由蚂蚁集团领投,老股东超额跟投。这是蚂蚁首次将投资触角延伸至触觉感知层,旨在推动具身智能发展。戴盟同时发布了全球首个驱动机器人灵巧操作的“物理交互脑”,将触觉感知与物理认知结合,提升机器人操作能力。

S信号87
机器之心

Meta发布开源模型Muse Glimmer,扎克伯格力挺开放路线

Meta发布了新的开放AI模型Muse Glimmer,并宣布将开放更强大的Muse Spark 1.2的权重,重新拥抱开源路线。扎克伯格发文强调开源AI对个人赋权的重要性,并批评其他实验室专注于为大型机构服务。Muse Glimmer采用Apache 2.0许可证,支持本地部署,但在某些评测中表现不及竞品。

A重点74
The AI Insider

Marquee 筹集 650 万美元,将 AI 决策层扩展至全球体育领域

Marquee 是一家面向职业体育组织的 AI 原生决策层公司,已筹集 650 万美元资金,由 Axel Springer SE、Welltech Ventures 等投资方支持。这笔资金将用于研发、战略招聘以及在美国和英国设立商业办公室。目前,Marquee 已服务超过 20 家职业俱乐部和联合会,并正在与 NBA 和欧洲联赛球队合作开发篮球平台。

S信号87
InfoQ

Meta 发布开源模型 Muse Glimmer,扎克伯格长文抨击闭源

Meta 于 8 月 10 日发布开源模型 Muse Glimmer,并宣布回归开放 AI 战略。CEO 扎克伯格发表长文,主张 AI 不应集中在少数机构手中。该模型专为本地智能体设计,可在消费级硬件上运行,但高内存需求仍是门槛。

A重点72
OpenAI Developers (X)

ChatGPT Work 和 Codex 现支持同步导入其他代理的工作

OpenAI 宣布 ChatGPT 桌面应用现在支持从其他代理导入项目、聊天、技能和插件,并可选择自动更新以保持同步。该功能旨在让用户更顺畅地将现有工作流程迁移到 Codex,减少中断。

A重点81
NVIDIA AI Blog

NVIDIA发布Nemotron 3.5 Lightning和NeMo Switchyard,提升代理式AI效率

NVIDIA发布了Nemotron 3.5 Lightning,一个300亿参数的混合专家模型,专为长时运行的代理式AI工作负载设计,提供高效率和智能。同时,NVIDIA还推出了NeMo Switchyard,一个开源库,用于在代理工具中智能路由请求到最合适的模型。这些发布旨在为企业提供对AI部署和运行的更大控制,支持从PC到云端的多种环境。

更多

A重点72
OpenAI (X)

ChatGPT 桌面应用现已在 Linux 上提供预览版

OpenAI 宣布 ChatGPT 桌面应用现已在 Linux 上提供预览版,支持 Ubuntu、Debian 和 Fedora 等发行版。用户可以通过 .deb 或 .rpm 包在 x64 或 ARM64 架构上安装,以便在 Linux 环境中使用 ChatGPT、ChatGPT Work 和 Codex。

S信号86
机器之心

黄仁勋宣布与六大金融机构合作,推动AI算力成为可投资资产

NVIDIA CEO黄仁勋在X上宣布,将与Apollo、BlackRock等六家金融机构合作,建立独立融资平台,目标撬动超过5000亿美元第三方资本,用于AI基础设施建设。此举旨在将AI算力从企业采购模式转变为类似电力、通信等基础设施的融资模式,并回应了循环融资的质疑。

A重点79
Google Gemini (X)

Gemini应用月活用户突破10亿

谷歌的Gemini应用月活跃用户已达到10亿,成为公司有史以来增长最快的产品,也是第14个达到这一里程碑的产品。这一消息通过社交媒体宣布,感谢了社区和Gemini团队的贡献。

A重点83
The AI Insider

英伟达与华尔街巨头合作,推动5000亿美元将AI芯片变为新资产类别

英伟达已与六家主要资产管理公司(包括阿波罗全球管理、黑石、贝莱德、布鲁克菲尔德、高盛和KKR)签署谅解备忘录,建立融资平台,旨在调动超过5000亿美元的第三方资本用于AI基础设施。该计划将使超大规模企业、AI实验室和企业能够在不依赖自身资产负债表的情况下为数据中心和英伟达硬件购买提供资金。此举回应了市场对大型科技公司巨额AI支出能否产生足够回报的担忧。

A重点83
AI Business

英伟达携手华尔街巨头,为AI筹集5000亿美元

英伟达正与华尔街主要金融机构合作,计划筹集5000亿美元用于AI基础设施建设。这笔资金旨在将计算和全栈基础设施确立为可投资的资产类别,标志着对AI发展的重大金融承诺。

A重点83
The AI Insider

Anthropic 称 Claude 改进了与黎曼猜想相关的长期数学下界

Anthropic 表示,其 AI 系统 Claude 在尝试证明黎曼猜想时,意外改进了与该猜想相关的长期数学下界,将其从 41.6% 提高到 67.2%。该结果已由 Anthropic 的数学家验证,并通过 Lean 形式化验证,但并未证明黎曼猜想本身。这一进展表明 AI 系统可能从解决既定问题转向贡献新的数学研究。

SynthePulse Insight阅读深度解读
A重点76
Kimmonismus (X)

Oumi 推出“复合 AI 工厂”,帮助企业构建和持续改进专用模型

Oumi 今日发布了其“复合 AI 工厂”平台,旨在帮助企业构建、部署和持续改进专用 AI 模型。该平台通过闭环流程,将模型在生产中的失败转化为训练信号,从而不断提升模型性能。这标志着企业 AI 从一次性部署转向持续学习循环,帮助企业积累智能而非仅仅租用。

A重点81
DeepTech深科技

成果三年两登Nature封面,这支清华团队想让AI换个方式看世界

清华大学类脑计算研究中心团队研发的天眸芯类脑视觉芯片,继天机芯后再次登上Nature封面。该技术将视觉信息拆解为RGB、时间差分和空间差分三类视觉原语,并组织成两条互补通路,在降低90%带宽的同时实现高速高动态范围感知。团队孵化的晰见科技正推动该技术的产业化,旨在为AI提供更高效的视觉感知方式。

A重点83
DeepTech深科技

红杉资本募得100亿美元押注AI,新领导层谈投资理念变革

红杉资本宣布募得约100亿美元用于成长和扩张策略基金,新任共同守护者林君睿和帕特·格雷迪接受专访,阐述投资决策不再需要共识,并表达对市场机会的乐观判断。此次募资和领导层更替源于内部信任危机,红杉正寻求重塑文化。

A重点79
The AI Insider

Meta发布开源权重模型“Muse Glimmer”,推动本地AI代理发展

Meta发布了开源权重AI模型Muse Glimmer,该模型旨在消费级硬件上本地运行AI代理,支持多步骤任务和隐私保护。此举体现了CEO马克·扎克伯格关于“个人超级智能”的愿景,但Meta仍保留其更强大的Muse Spark模型不开放。

A重点83
机器之心

EverMind 将 AI 自进化推向产品:HarnessBank 让模型越用越聪明

EverMind 推出 HarnessBank、Raven 与 EverMe,将 AI 自进化从研究推向产品。其核心架构通过任务 Agent 与进化 Agent 分离,在冻结模型权重的情况下仅优化 Harness,在多个基准上取得显著提升,并解决了自进化中的验证与数据问题。

A重点81
量子位

Meta重返开源!30B本地Agent塞进24GB显存,LeCun火速力挺

Meta发布了名为Muse Glimmer的开源模型,该模型拥有约300亿参数,经过量化后可在24GB显存的消费级显卡上运行,支持本地Agent功能。Meta CEO扎克伯格同时宣布公司将恢复发布部分开放模型,并强调开源的重要性。

A重点81
AI前线

除夕紧急上线3000张昇腾芯片,华为云助DeepSeek应对流量洪峰

2025年春节期间,DeepSeek用户激增导致算力紧张,华为云紧急集结230多名技术骨干,在除夕至大年初二期间部署3000多张昇腾芯片,成功将DeepSeek-V3/R1模型部署到华为云贵安数据中心昇腾云上。这一行动不仅保障了DeepSeek的稳定运行,也展示了国产算力支持国产大模型的潜力,推动了中国AI行业的加速发展。

A重点81
机器之心

寻明生科4个月再融1亿美元,加速构建AI生物世界模型

寻明生科(Aureka)在完成A+轮融资仅4个月后,又获得了1亿美元B轮融资。该公司致力于构建横跨数字与生物世界的药物发现基础设施,利用AI设计抗体等大分子药物,并计划打造一个生物世界模型。

A重点76
Latent Space

生物AI转型:Chai Discovery联合创始人与产品负责人的播客访谈

本文宣布了一期播客访谈,嘉宾是Chai Discovery的联合创始人Matthew McPartlon和产品负责人Neil Patil。访谈讨论了在JPM制药大会上宣布的多项AI制药工具交易,以及AI工具如何变得足够可靠,从而加速药物发现并实现新能力。Chai Discovery估值达40亿美元,尽管成立仅两年。

A重点79
机器之心

清华天眸芯团队再登Nature系列期刊封面,类脑互补视觉范式重塑AI感知世界的方式

清华大学类脑计算研究中心团队在继2024年《Nature》封面后,再次以类脑互补视觉感知研究登上《Nature Sensors》封面。该研究提出了基于视觉原语的自监督表征学习框架,无需真值标注即可从退化数据中学习,并开源了算法工具链TianMouCV,推动互补视觉走向Physical AI应用。

A重点72
Andrew Curran (X)

重磅消息:布拉德·莱特卡普将离开OpenAI,开启新事业

OpenAI首席运营官布拉德·莱特卡普宣布将离开公司,创办新事业。他在给团队的内部信中表示,对OpenAI的未来充满信心,并感谢团队的支持。这一变动标志着OpenAI领导层的重大调整。

A重点76
The AI Insider

AI合规初创公司Dili宣布1500万美元A轮融资,应对基础设施监管负担

专注于美国基础设施项目的AI合规公司Dili宣布完成1500万美元A轮融资,由Khosla Ventures领投,Allianz、Rebel Fund等参投。该公司利用AI将非结构化文档转换为结构化数据,并应用确定性规则确保符合联邦法规,如戴维斯-培根工资要求和IRA相关劳动规则。随着AI驱动的数据中心和电力基础设施建设的加速,Dili旨在通过持续监控帮助项目避免数百万美元的罚款。

A重点74
The AI Insider

Wayy.ai 宣布完成 200 万美元 Pre-Seed 轮融资并推出 AI 销售联合创始人平台

Wayy.ai 宣布完成 200 万美元的 Pre-Seed 轮融资,由 0 to 1 Ventures 领投,并正式推出其 AI 驱动的虚拟销售联合创始人平台。该平台旨在帮助个体创业者和小企业主自动化销售流程,目前已有约 70 家公司使用。融资将用于扩大市场推广和加速产品开发。

A重点76
THE DECODER

Nvidia开源Nemotron 3.5 Lightning:速度优先,智能不减

Nvidia发布了开源权重的Nemotron 3.5 Lightning模型,该模型仅有36亿个活跃参数,但在智能指数上与OpenAI的gpt-oss-120b相当,尽管体积小四倍。其推理速度接近每秒670个token,是对比中最快的模型,表明Nvidia更注重效率而非规模。

A重点78
量子位

Manus宣布恢复独立运营,将删除部分用户数据

Manus正式宣布从Meta拆分,恢复独立公司运营。作为拆分的一部分,部分用户数据将被删除,但公司提供了备份工具。Manus表示正在筹备新功能,以继续拓展AI Agent的能力边界。

A重点78
THE DECODER

Anthropic 大规模 IPO 面临投资者对中国竞争对手和政治逆风的质疑

Anthropic 计划于九月或十月进行首次公开募股(IPO),估值达 9650 亿美元,可能成为史上最大规模。然而,在投资者会议中,公司面临关于中国竞争对手、与特朗普政府的紧张关系以及数据中心建设抗议等尖锐问题。此次 IPO 的估值很可能为整个 AI 行业的估值设定基准。

A重点79
InfoQ

从“会用”到“驾驭”:AI Coding 进入生产环境的真实碰撞

InfoQ《极客有约》直播邀请网易游戏、网龙网络、平凯数据库和汇丰科技的技术专家,探讨AI Coding在生产环境中的实践与挑战。专家们指出,AI Coding在遗留代码改造、组织协同、质量保障和安全治理等方面带来新问题,但也提升了效率。文章还预告了AICon 2026深圳站的相关专题。

A重点74
TestingCatalog (X)

SpaceXAI 为 Grok 推出语音连接器,可生成语音备忘录

SpaceXAI 宣布为 Grok 推出新的语音连接器,该功能可以生成语音备忘录,并将每日事件转化为个性化播客或创建自动化每日简报。目前该功能已在 iOS、Android 和 Web 平台上线,无需额外设置即可使用。

A重点76
The AI Insider

OpenAI扩展Daybreak网络安全服务并完成70亿美元员工股票回购

OpenAI宣布扩展其网络安全服务Daybreak,推出新的网络防御模型GPT-5.6 Cyber,以应对日益增长的AI代理恶意使用风险。同时,公司完成了70亿美元的员工股票回购,估值达8520亿美元,并已秘密提交IPO申请。

A重点74
量子位

Anthropic CEO因过度关注AI风险引发投资者不满,IPO前景受关注

据预测,Anthropic可能于10月底进行IPO,预计募资超600亿美元。但投资者对CEO Dario Amodei过度强调AI风险表示不满,希望他更多关注盈利。此外,Anthropic的Claude模型在测试中意外接入真实互联网,引发安全担忧,进一步加剧了外界对IPO的疑虑。

A重点74
meng shao (X)

ZCode 加入「RESET」并庆祝用户达 100 万

ZCode 宣布加入「RESET」计划,并庆祝其用户数达到 100 万。作为感谢,ZCode 重置了所有 GLM Coding Plan 用户的用量限制,并推出更新以提高实际工程工作流中的智能性,实现 98% 的缓存命中率,提供约 1.8 倍的额外用量。

A重点76
The AI Insider

AI数据投毒:机器学习模型背后的供应链风险

本文探讨了AI数据投毒这一供应链风险,攻击者通过操纵训练数据影响模型行为。文章提到JFrog在2024年2月扫描Hugging Face时发现约100个恶意模型,其中一些在加载时执行任意代码。文章还讨论了防御措施,如验证模型来源和保护训练数据集。

A重点72
NVIDIA Developer Blog

NVIDIA 发布 Nemotron 3.5 Lightning,加速长时运行代理的执行任务

NVIDIA 发布了 Nemotron 3.5 Lightning,一个开放的 30B 混合专家模型,具有 3B 激活参数,专为长时运行 AI 代理的高频执行任务设计,如工具调用和结果验证。该模型旨在降低延迟和成本,同时保持准确性。

A重点72
NVIDIA Developer Blog

NVIDIA NeMo Switchyard:跨模型路由AI代理工作负载

NVIDIA 发布了 NeMo Switchyard,这是一个用于在多个 AI 模型之间路由代理工作负载的工具,以优化成本、延迟和准确性。该工具允许开发者根据任务需求动态选择最合适的模型,避免将所有请求发送到最大的模型。

A重点72
TestingCatalog (X)

River AI 融资 11 亿美元,致力于打造个人专属 AI

River AI 宣布获得 11 亿美元融资,旨在构建由每个人拥有和塑造的个性化 AI。其首个产品是 River API,允许用户基于开源模型构建定制代理和 LLM。

A重点72
The AI Insider

RoboStore 推出美国机器人制造与集成公司 Robo Inc.

RoboStore 推出了美国机器人制造与集成公司 Robo Inc.,计划在长岛开设 66,000 平方英尺的工厂,预计 2027 年第一季度全面运营。此举正值美国对先进外国制造机器人实施新限制之后,Robo Inc. 将专注于美国本土组装、本地化数据基础设施和合规集成。

A重点72
Mark Kretzschmann (X)

Anthropic为Claude引入文本水印:GPTZero CTO详解其原理与局限

GPTZero的CTO撰写了一篇深度解析文章,说明Anthropic、Google和OpenAI如何构建文本水印技术,并即将应用于Claude生成的所有文本。文章解释了水印的生成和检测过程,并讨论了通过改写或统计模型可能规避水印的方法,以及水印对文本质量的微小影响。

A重点76
InfoQ

Bun 用 Claude 重写为 Rust,Zig 创始人批评其代码质量

Bun 的创建者 Jarred Sumner 利用 Claude 智能体在 11 天内将 Bun 从 Zig 重写为 Rust,耗资约 16.5 万美元。Zig 创始人 Andrew Kelley 批评该项目的编码实践,认为其缺乏把关,导致代码质量低下。此事引发了对 AI 驱动大规模重构的讨论。

A重点74
THE DECODER

OpenAI 推出 ChatGPT Business 高级席位,每月 125 美元

OpenAI 为 ChatGPT Business 客户推出“高级席位”,每个用户每月收费 125 美元,是标准席位价格的五倍。该计划提供更多容量且无五小时使用限制,反映出随着代理式 AI 消耗更多令牌,AI 提供商正在调整定价策略。

A重点74
THE DECODER

Anthropic与比特币矿商Riot Platforms签署91亿美元数据中心协议

Anthropic已与比特币矿商Riot Platforms签署了一项价值91亿美元的数据中心租赁协议,位于德克萨斯州Rockdale工厂,并有可能扩展至161亿美元。该交易凸显了Anthropic在基础设施领域的积极扩张,其合作伙伴包括亚马逊、SpaceX和谷歌等。

A重点74
量子位

在Claude Code里用GPT被秒封!义父Tibo:别急,我给你重置

OpenAI Codex负责人Tibo发布教程,教用户在Claude Code中使用GPT模型,并承诺被封号就重置额度。开发者Alex Getman照做后被Anthropic封号,引发社区讨论。Tibo回应无法干预,但兑现承诺重置了所有付费用户额度,Anthropic负责人表示不会因调用其他模型封号。

A重点71
宝玉 (X)

100万美元Token不限量实验:AI成本高于人力,效率提升遇瓶颈

一位硅谷AI公司团队负责人分享了其团队进行100万美元预算、不限量Token使用AI的实验结果。实验发现,AI成本高昂,甚至超过人力成本,且团队成员更累,效率提升遭遇瓶颈。作者认为,AI的真正价值在于从0到1的普及,而非无限消耗Token。

A重点72
InfoQ

AI编程辩论:资深工程师受益,新人面临挑战

在2026世界人工智能大会期间,InfoQ直播间讨论了AI编程智能体对软件开发的影响。专家认为AI正在放大资深工程师的价值,而新人和大型组织面临冲击。同时,Token消耗不再是衡量标准,任务完成和价值产出更为重要。

A重点72
量子位
3

谷歌创始人布林紧急接管Gemini团队,但"3.5 Pro已被取消"

谷歌联合创始人谢尔盖·布林重新深度介入Gemini团队,而据SemiAnalysis报道,Gemini 3.5 Pro已被悄悄取消。谷歌面临旗舰模型缺失和人事动荡,Gemini 4也被认为难以扭转颓势。

A重点72
钛媒体AGI

英伟达携手六家金融机构,拟动员5000亿美元投入AI算力融资

英伟达与阿波罗、贝莱德等六家金融机构签署谅解备忘录,设立算力融资平台,目标是为AI基础设施动员超过5000亿美元的第三方资本。此举将GPU算力包装成可投资资产,缓解客户采购压力,但也引发市场对循环融资风险的担忧。

A重点71
机器之心

openJiuwen协同昇腾推出「算力亲和」技术,显著降低推理时延与存储占用

华为团队联合打造的openJiuwen开源智能体平台与昇腾协同,推出「算力亲和」技术,通过Agent Hint机制实现KV Cache的主动管理,使首token时延降低一半,推理存储占用下降25%。该技术打通了Agent框架与推理引擎的语义通道,有望提升多智能体任务的推理效率。

精选事件
58
来源
23
精选
12
更多
46
全部列表