扩展AI计算性能需要新的电源架构
NVIDIA、谷歌和微软正合作开发一种新的800 VDC电源架构,旨在提高AI数据中心的效率和可扩展性。他们已发布相关规范,并与80多家制造商合作生产兼容产品。NVIDIA计划在2026年下半年推出800 VDC电源机架,以实现混合AC/DC设施。
AI 日报
2026-08-11
精选事件
58
来源
23
精选
12
更多
46
AI DAILY BRIEFING
NVIDIA在AI基础设施和模型方面双线推进,发布800 VDC电源架构和Nemotron 3.5 Lightning模型,同时Anthropic为合规引入水印,Meta重新拥抱开源,显示行业在性能、合规和开放性上的多重博弈。
NVIDIA通过电源架构创新和高效模型发布,持续巩固其在AI基础设施和推理性能上的领先地位。
Anthropic的水印技术是AI合规的重要一步,但可能引发对模型透明度和隐私的进一步讨论。
Meta开源Muse Glimmer表明开源路线仍是重要战略,但性能差距可能影响其竞争力。
下一步关注:关注NVIDIA 800V电源架构的实际部署效果,以及Anthropic水印技术的实施细节和行业反应。
NVIDIA、谷歌和微软正合作开发一种新的800 VDC电源架构,旨在提高AI数据中心的效率和可扩展性。他们已发布相关规范,并与80多家制造商合作生产兼容产品。NVIDIA计划在2026年下半年推出800 VDC电源机架,以实现混合AC/DC设施。
NVIDIA 发布了 Nemotron 3.5 Lightning,一个开放的 30B MoE 模型,具有 3B 激活参数,专为高容量、专业化任务设计,输出速度比同类模型快 4 倍。同时,NVIDIA 还发布了 NeMo Switchyard,一个用于模型路由的开源库,以优化代理工作流。该模型权重、数据和配方已在 Hugging Face 上开放。
Anthropic 宣布将对其 AI 模型(包括 Claude)生成的文本添加水印,以遵守欧盟《人工智能法案》的透明度规范。该规范自 8 月 2 日起生效,要求 AI 公司以可被其他系统检测的方式标记 AI 生成的内容。Anthropic 表示,8 月 2 日之后发布的所有模型将自动包含水印技术,并支持 C2PA 开放标准。
北京大学与可灵团队提出RefCaptioner,通过后训练强化模型对参考图的识别与绑定能力,并构建结构化视频描述,解决多参考图场景下视频理解模型对应能力下降的问题。该方法采用混合数据SFT和双层自适应奖励函数HCD-GRPO,提升参考图与视频语义的精准对应。
安全研究人员在OpenAI、Anthropic和Google的API中发现了一个漏洞,该漏洞允许他们提取加密的推理痕迹并在模型之间移动。对公共会话的扫描发现了数十个密码和API密钥,表明用户的敏感信息可能被泄露。此外,推理摘要往往隐藏了模型实际执行的操作,引发了隐私和透明度的担忧。
Dyna Robotics 发布了 Dyna-2,这是一个基于超过一百万小时第一人称人类视频训练的机器人基础模型,旨在通过观察人类活动来学习物理世界的变化。该公司声称,该模型在机器人性能上表现出可预测的扩展规律,并有望加速商用自动化的发展。
戴盟机器人宣布完成数亿元战略轮融资,由蚂蚁集团领投,老股东超额跟投。这是蚂蚁首次将投资触角延伸至触觉感知层,旨在推动具身智能发展。戴盟同时发布了全球首个驱动机器人灵巧操作的“物理交互脑”,将触觉感知与物理认知结合,提升机器人操作能力。
Meta发布了新的开放AI模型Muse Glimmer,并宣布将开放更强大的Muse Spark 1.2的权重,重新拥抱开源路线。扎克伯格发文强调开源AI对个人赋权的重要性,并批评其他实验室专注于为大型机构服务。Muse Glimmer采用Apache 2.0许可证,支持本地部署,但在某些评测中表现不及竞品。
Marquee 是一家面向职业体育组织的 AI 原生决策层公司,已筹集 650 万美元资金,由 Axel Springer SE、Welltech Ventures 等投资方支持。这笔资金将用于研发、战略招聘以及在美国和英国设立商业办公室。目前,Marquee 已服务超过 20 家职业俱乐部和联合会,并正在与 NBA 和欧洲联赛球队合作开发篮球平台。
Meta 于 8 月 10 日发布开源模型 Muse Glimmer,并宣布回归开放 AI 战略。CEO 扎克伯格发表长文,主张 AI 不应集中在少数机构手中。该模型专为本地智能体设计,可在消费级硬件上运行,但高内存需求仍是门槛。
OpenAI 宣布 ChatGPT 桌面应用现在支持从其他代理导入项目、聊天、技能和插件,并可选择自动更新以保持同步。该功能旨在让用户更顺畅地将现有工作流程迁移到 Codex,减少中断。
NVIDIA发布了Nemotron 3.5 Lightning,一个300亿参数的混合专家模型,专为长时运行的代理式AI工作负载设计,提供高效率和智能。同时,NVIDIA还推出了NeMo Switchyard,一个开源库,用于在代理工具中智能路由请求到最合适的模型。这些发布旨在为企业提供对AI部署和运行的更大控制,支持从PC到云端的多种环境。
OpenAI 宣布 ChatGPT 桌面应用现已在 Linux 上提供预览版,支持 Ubuntu、Debian 和 Fedora 等发行版。用户可以通过 .deb 或 .rpm 包在 x64 或 ARM64 架构上安装,以便在 Linux 环境中使用 ChatGPT、ChatGPT Work 和 Codex。
NVIDIA CEO黄仁勋在X上宣布,将与Apollo、BlackRock等六家金融机构合作,建立独立融资平台,目标撬动超过5000亿美元第三方资本,用于AI基础设施建设。此举旨在将AI算力从企业采购模式转变为类似电力、通信等基础设施的融资模式,并回应了循环融资的质疑。
谷歌的Gemini应用月活跃用户已达到10亿,成为公司有史以来增长最快的产品,也是第14个达到这一里程碑的产品。这一消息通过社交媒体宣布,感谢了社区和Gemini团队的贡献。
英伟达已与六家主要资产管理公司(包括阿波罗全球管理、黑石、贝莱德、布鲁克菲尔德、高盛和KKR)签署谅解备忘录,建立融资平台,旨在调动超过5000亿美元的第三方资本用于AI基础设施。该计划将使超大规模企业、AI实验室和企业能够在不依赖自身资产负债表的情况下为数据中心和英伟达硬件购买提供资金。此举回应了市场对大型科技公司巨额AI支出能否产生足够回报的担忧。
英伟达正与华尔街主要金融机构合作,计划筹集5000亿美元用于AI基础设施建设。这笔资金旨在将计算和全栈基础设施确立为可投资的资产类别,标志着对AI发展的重大金融承诺。
Anthropic 表示,其 AI 系统 Claude 在尝试证明黎曼猜想时,意外改进了与该猜想相关的长期数学下界,将其从 41.6% 提高到 67.2%。该结果已由 Anthropic 的数学家验证,并通过 Lean 形式化验证,但并未证明黎曼猜想本身。这一进展表明 AI 系统可能从解决既定问题转向贡献新的数学研究。
SynthePulse Insight阅读深度解读Oumi 今日发布了其“复合 AI 工厂”平台,旨在帮助企业构建、部署和持续改进专用 AI 模型。该平台通过闭环流程,将模型在生产中的失败转化为训练信号,从而不断提升模型性能。这标志着企业 AI 从一次性部署转向持续学习循环,帮助企业积累智能而非仅仅租用。
清华大学类脑计算研究中心团队研发的天眸芯类脑视觉芯片,继天机芯后再次登上Nature封面。该技术将视觉信息拆解为RGB、时间差分和空间差分三类视觉原语,并组织成两条互补通路,在降低90%带宽的同时实现高速高动态范围感知。团队孵化的晰见科技正推动该技术的产业化,旨在为AI提供更高效的视觉感知方式。
红杉资本宣布募得约100亿美元用于成长和扩张策略基金,新任共同守护者林君睿和帕特·格雷迪接受专访,阐述投资决策不再需要共识,并表达对市场机会的乐观判断。此次募资和领导层更替源于内部信任危机,红杉正寻求重塑文化。
Meta发布了开源权重AI模型Muse Glimmer,该模型旨在消费级硬件上本地运行AI代理,支持多步骤任务和隐私保护。此举体现了CEO马克·扎克伯格关于“个人超级智能”的愿景,但Meta仍保留其更强大的Muse Spark模型不开放。
Anthropic宣布将在新款Claude模型中嵌入隐形文本水印,并签署欧盟AI法案的透明度准则。该水印作为文本的一部分,难以去除,且全球适用。此举引发网友热议,但公司未公开算法细节。
EverMind 推出 HarnessBank、Raven 与 EverMe,将 AI 自进化从研究推向产品。其核心架构通过任务 Agent 与进化 Agent 分离,在冻结模型权重的情况下仅优化 Harness,在多个基准上取得显著提升,并解决了自进化中的验证与数据问题。
Meta发布了名为Muse Glimmer的开源模型,该模型拥有约300亿参数,经过量化后可在24GB显存的消费级显卡上运行,支持本地Agent功能。Meta CEO扎克伯格同时宣布公司将恢复发布部分开放模型,并强调开源的重要性。
2025年春节期间,DeepSeek用户激增导致算力紧张,华为云紧急集结230多名技术骨干,在除夕至大年初二期间部署3000多张昇腾芯片,成功将DeepSeek-V3/R1模型部署到华为云贵安数据中心昇腾云上。这一行动不仅保障了DeepSeek的稳定运行,也展示了国产算力支持国产大模型的潜力,推动了中国AI行业的加速发展。
寻明生科(Aureka)在完成A+轮融资仅4个月后,又获得了1亿美元B轮融资。该公司致力于构建横跨数字与生物世界的药物发现基础设施,利用AI设计抗体等大分子药物,并计划打造一个生物世界模型。
本文宣布了一期播客访谈,嘉宾是Chai Discovery的联合创始人Matthew McPartlon和产品负责人Neil Patil。访谈讨论了在JPM制药大会上宣布的多项AI制药工具交易,以及AI工具如何变得足够可靠,从而加速药物发现并实现新能力。Chai Discovery估值达40亿美元,尽管成立仅两年。
清华大学类脑计算研究中心团队在继2024年《Nature》封面后,再次以类脑互补视觉感知研究登上《Nature Sensors》封面。该研究提出了基于视觉原语的自监督表征学习框架,无需真值标注即可从退化数据中学习,并开源了算法工具链TianMouCV,推动互补视觉走向Physical AI应用。
OpenAI首席运营官布拉德·莱特卡普宣布将离开公司,创办新事业。他在给团队的内部信中表示,对OpenAI的未来充满信心,并感谢团队的支持。这一变动标志着OpenAI领导层的重大调整。
专注于美国基础设施项目的AI合规公司Dili宣布完成1500万美元A轮融资,由Khosla Ventures领投,Allianz、Rebel Fund等参投。该公司利用AI将非结构化文档转换为结构化数据,并应用确定性规则确保符合联邦法规,如戴维斯-培根工资要求和IRA相关劳动规则。随着AI驱动的数据中心和电力基础设施建设的加速,Dili旨在通过持续监控帮助项目避免数百万美元的罚款。
Wayy.ai 宣布完成 200 万美元的 Pre-Seed 轮融资,由 0 to 1 Ventures 领投,并正式推出其 AI 驱动的虚拟销售联合创始人平台。该平台旨在帮助个体创业者和小企业主自动化销售流程,目前已有约 70 家公司使用。融资将用于扩大市场推广和加速产品开发。
Nvidia发布了开源权重的Nemotron 3.5 Lightning模型,该模型仅有36亿个活跃参数,但在智能指数上与OpenAI的gpt-oss-120b相当,尽管体积小四倍。其推理速度接近每秒670个token,是对比中最快的模型,表明Nvidia更注重效率而非规模。
Manus正式宣布从Meta拆分,恢复独立公司运营。作为拆分的一部分,部分用户数据将被删除,但公司提供了备份工具。Manus表示正在筹备新功能,以继续拓展AI Agent的能力边界。
Manus AI宣布将恢复为独立公司运营,部分用户需在2026年8月23日前备份数据,并在8月25日后恢复数据。公司将为受影响的用户提供支持,并预告新功能。
Anthropic 计划于九月或十月进行首次公开募股(IPO),估值达 9650 亿美元,可能成为史上最大规模。然而,在投资者会议中,公司面临关于中国竞争对手、与特朗普政府的紧张关系以及数据中心建设抗议等尖锐问题。此次 IPO 的估值很可能为整个 AI 行业的估值设定基准。
InfoQ《极客有约》直播邀请网易游戏、网龙网络、平凯数据库和汇丰科技的技术专家,探讨AI Coding在生产环境中的实践与挑战。专家们指出,AI Coding在遗留代码改造、组织协同、质量保障和安全治理等方面带来新问题,但也提升了效率。文章还预告了AICon 2026深圳站的相关专题。
SpaceXAI 宣布为 Grok 推出新的语音连接器,该功能可以生成语音备忘录,并将每日事件转化为个性化播客或创建自动化每日简报。目前该功能已在 iOS、Android 和 Web 平台上线,无需额外设置即可使用。
OpenAI宣布扩展其网络安全服务Daybreak,推出新的网络防御模型GPT-5.6 Cyber,以应对日益增长的AI代理恶意使用风险。同时,公司完成了70亿美元的员工股票回购,估值达8520亿美元,并已秘密提交IPO申请。
据预测,Anthropic可能于10月底进行IPO,预计募资超600亿美元。但投资者对CEO Dario Amodei过度强调AI风险表示不满,希望他更多关注盈利。此外,Anthropic的Claude模型在测试中意外接入真实互联网,引发安全担忧,进一步加剧了外界对IPO的疑虑。
ZCode 宣布加入「RESET」计划,并庆祝其用户数达到 100 万。作为感谢,ZCode 重置了所有 GLM Coding Plan 用户的用量限制,并推出更新以提高实际工程工作流中的智能性,实现 98% 的缓存命中率,提供约 1.8 倍的额外用量。
本文探讨了AI数据投毒这一供应链风险,攻击者通过操纵训练数据影响模型行为。文章提到JFrog在2024年2月扫描Hugging Face时发现约100个恶意模型,其中一些在加载时执行任意代码。文章还讨论了防御措施,如验证模型来源和保护训练数据集。
NVIDIA 发布了 Nemotron 3.5 Lightning,一个开放的 30B 混合专家模型,具有 3B 激活参数,专为长时运行 AI 代理的高频执行任务设计,如工具调用和结果验证。该模型旨在降低延迟和成本,同时保持准确性。
NVIDIA 发布了 NeMo Switchyard,这是一个用于在多个 AI 模型之间路由代理工作负载的工具,以优化成本、延迟和准确性。该工具允许开发者根据任务需求动态选择最合适的模型,避免将所有请求发送到最大的模型。
River AI 宣布获得 11 亿美元融资,旨在构建由每个人拥有和塑造的个性化 AI。其首个产品是 River API,允许用户基于开源模型构建定制代理和 LLM。
RoboStore 推出了美国机器人制造与集成公司 Robo Inc.,计划在长岛开设 66,000 平方英尺的工厂,预计 2027 年第一季度全面运营。此举正值美国对先进外国制造机器人实施新限制之后,Robo Inc. 将专注于美国本土组装、本地化数据基础设施和合规集成。
GPTZero的CTO撰写了一篇深度解析文章,说明Anthropic、Google和OpenAI如何构建文本水印技术,并即将应用于Claude生成的所有文本。文章解释了水印的生成和检测过程,并讨论了通过改写或统计模型可能规避水印的方法,以及水印对文本质量的微小影响。
Bun 的创建者 Jarred Sumner 利用 Claude 智能体在 11 天内将 Bun 从 Zig 重写为 Rust,耗资约 16.5 万美元。Zig 创始人 Andrew Kelley 批评该项目的编码实践,认为其缺乏把关,导致代码质量低下。此事引发了对 AI 驱动大规模重构的讨论。
OpenAI 为 ChatGPT Business 客户推出“高级席位”,每个用户每月收费 125 美元,是标准席位价格的五倍。该计划提供更多容量且无五小时使用限制,反映出随着代理式 AI 消耗更多令牌,AI 提供商正在调整定价策略。
Anthropic已与比特币矿商Riot Platforms签署了一项价值91亿美元的数据中心租赁协议,位于德克萨斯州Rockdale工厂,并有可能扩展至161亿美元。该交易凸显了Anthropic在基础设施领域的积极扩张,其合作伙伴包括亚马逊、SpaceX和谷歌等。
OpenAI Codex负责人Tibo发布教程,教用户在Claude Code中使用GPT模型,并承诺被封号就重置额度。开发者Alex Getman照做后被Anthropic封号,引发社区讨论。Tibo回应无法干预,但兑现承诺重置了所有付费用户额度,Anthropic负责人表示不会因调用其他模型封号。
一位硅谷AI公司团队负责人分享了其团队进行100万美元预算、不限量Token使用AI的实验结果。实验发现,AI成本高昂,甚至超过人力成本,且团队成员更累,效率提升遭遇瓶颈。作者认为,AI的真正价值在于从0到1的普及,而非无限消耗Token。
黄仁勋宣布NVIDIA与Apollo、BlackRock、Blackstone等华尔街机构合作,建立独立融资平台,计划撬动超过5000亿美元的第三方资本用于AI基础设施建设。他强调AI工厂算力正成为一种可投资的资产类别,并回应了关于循环投资的质疑。
在2026世界人工智能大会期间,InfoQ直播间讨论了AI编程智能体对软件开发的影响。专家认为AI正在放大资深工程师的价值,而新人和大型组织面临冲击。同时,Token消耗不再是衡量标准,任务完成和价值产出更为重要。
谷歌联合创始人谢尔盖·布林重新深度介入Gemini团队,而据SemiAnalysis报道,Gemini 3.5 Pro已被悄悄取消。谷歌面临旗舰模型缺失和人事动荡,Gemini 4也被认为难以扭转颓势。
英伟达与阿波罗、贝莱德等六家金融机构签署谅解备忘录,设立算力融资平台,目标是为AI基础设施动员超过5000亿美元的第三方资本。此举将GPU算力包装成可投资资产,缓解客户采购压力,但也引发市场对循环融资风险的担忧。
机器学习先驱Daphne Koller在a16z News发表长文,指出AI制药的瓶颈不在分子设计,而在上游的疾病机制理解。她估算现有数据与建立完整生物学因果模型所需数据相差约1000倍,并警告行业正围绕越来越少的靶点制造越来越多的药物。
华为团队联合打造的openJiuwen开源智能体平台与昇腾协同,推出「算力亲和」技术,通过Agent Hint机制实现KV Cache的主动管理,使首token时延降低一半,推理存储占用下降25%。该技术打通了Agent框架与推理引擎的语义通道,有望提升多智能体任务的推理效率。