AI 日报

2026-08-17

谷歌允许移除AI水印,OpenAI安全团队解散,开源模型逼近闭源

AI DAILY BRIEFING

AI行业在安全、基础设施和模型能力方面迎来多项重要进展。谷歌宣布允许用户移除AI生成内容上的可见水印,同时保留不可见追踪技术,引发关于内容透明度的讨论。OpenAI解散Preparedness安全团队,负责人离职,引发内部不安。NVIDIA与SB Energy合作确保AI工厂基础设施,OpenAI将成为租户,凸显计算资源对前沿AI发展的关键作用。

AI安全治理面临挑战:OpenAI解散安全团队,谷歌放宽水印限制,行业在安全与透明度之间寻求平衡。

开源模型性能快速提升:Prime Intellect的Harness方法和Qwen3.8-27B的爆火表明,开源模型通过优化流程和社区支持,正逼近甚至超越闭源模型。

世界模型成为新焦点:智象未来和Alaya Lab分别发布交互式世界模型和长视频生成模型,推动AI从内容生成向可交互、长时序模拟演进。

下一步关注:关注OpenAI安全团队解散后的后续影响,以及谷歌水印移除功能的具体实施细节。同时,世界模型在WBench等评测中的表现和开源模型的社区优化进展值得持续跟踪。

精选

A重点83
The AI Insider
2

谷歌将允许用户禁用AI生成内容上的可见水印

谷歌宣布将允许用户移除AI生成图片、视频和歌曲上的可见水印,同时保留不可见的追踪技术。该功能将应用于Gemini、Flow等工具,并计划扩展到搜索。谷歌还开源了Credentio库,以帮助开发者验证内容凭证。

SynthePulse Insight阅读深度解读
A重点83
量子位
2

OpenAI解散Preparedness安全团队,负责人离职

OpenAI解散了负责评估前沿AI灾难性风险的Preparedness团队,称安全工作已融入开发流程。该团队负责人Dylan Scandinaro离职,转向研究递归自我改进AI的安全风险。此前已有多个安全团队解散或高管离职,引发内部员工不安。

SynthePulse Insight阅读深度解读
S信号86
NVIDIA AI Blog

NVIDIA与SB Energy合作确保AI工厂基础设施

NVIDIA宣布与SB Energy合作,在俄亥俄州朴茨茅斯的PORTS-Pike科技园区获得液化石油气(LPS)容量,以托管NVIDIA计算,OpenAI将成为租户。此举旨在确保AI工厂的关键基础设施,因为前沿AI实验室的增长越来越受计算可用性而非算法或客户需求的限制。

A重点83
机器之心
2

智象未来发布全球首款原生全模态交互式世界模型HiDream-O1-World,登顶WBench评测

智象未来今日发布了全球首款原生全模态交互式世界模型HiDream-O1-World,该模型基于自研UiT架构,支持文本、图像、交互等多模态输入,能够生成具备长时空一致性和物理一致性的动态世界。在美团LongCat与复旦大学联合推出的WBench评测中,HiDream-O1-World首次参评便登顶Navi分榜,物理维度得分73.3,一致性维度得分88.0,综合排名第一。这一发布标志着AI内容生成从单向输出向可交互、可探索的世界模型迈进。

SynthePulse Insight阅读深度解读
S信号87
AI前线

Qwen3.8-27B 开源即爆火:两天下载破百万,社区竞相优化

Qwen3.8-27B 是阿里巴巴开源的一款 27B 参数多模态模型,在编程和智能体任务上表现超越 Claude Opus 4.6 Max。发布后迅速获得开发者青睐,两天内下载量突破 100 万,并得到 NVIDIA、AMD 等硬件厂商和推理工具的快速适配。这一事件凸显了开源模型在本地部署和工程优化方面的巨大潜力。

一张性能对比表格,展示Qwen3.8-27B在编码、代理任务和通用能力等多类基准测试中的得分,与Qwen3.6-27B、Qwen3.7-Plus、Muse Glimmer-30B及Opus4.6 Max对比,突出其在编程和Agentic任务
S信号86
量子位

世界模型一口气输出小时级视频不跑偏,开源了

Alaya Lab联合中国科学技术大学与上海创智学院推出了视频世界模型Alaya-EVOKE,能够连续生成120分钟、4800个片段、172800帧的一镜到底视频,且仅需3步去噪。该模型通过将记忆外部化到世界状态银行,并改造教师模型以提供长时序监督,解决了长视频生成中的色彩漂移、内容漂移和显存限制等问题。在WBench导航子集和VBench-2.0上均取得领先成绩。

六组科幻场景切换前后对比图:冻原极光、夜间山湖流星、晶柱峡谷电弧、休眠环状巨构能量柱,每组含'切换前'与'切换后'画面及Move/Rot滑块控制界面。
A重点74
阿里云开发者

Qwen-Audio-3.0系列语音模型正式上线千问AI平台

阿里巴巴正式在千问AI平台上线Qwen-Audio-3.0系列语音模型,包括语音识别、语音合成和实时交互三个版本。该系列在Artificial Analysis语音排行榜上获得三项全球第一,开发者可通过API或Token Plan订阅使用,目前已应用于千问App等产品。

SynthePulse Insight阅读深度解读
A重点81
腾讯技术工程

Agent的上限,可能不在模型,而在团队知识

本文介绍了安全中心团队在AI时代重构知识库的实践,强调Agent作为主要知识消费者时,知识供给系统需实现结构化、流程自动沉淀和动态淘汰。作者提出了从目标定义到飞轮运转的完整方法论,并分享了关键决策和可复用方法。

A重点83
量子位

COLM 2026多篇论文质疑Transformer默认设计,揭示长上下文与梯度传播隐患

COLM 2026上,多篇论文同时挑战Transformer的默认架构选择,如QK归一化、GQA和滑动窗口注意力,发现这些设计在长上下文任务中表现不佳,且组合使用会加剧性能下降。另一项研究指出输出投影层在反向传播中丢失大量梯度信息,影响训练效率。这些发现可能促使未来模型设计重新评估这些看似合理的默认配置。

SynthePulse Insight阅读深度解读
A重点81
THE DECODER

OpenAI签署俄亥俄州数据中心租约,英伟达提供高达1050亿美元担保

OpenAI已签署一份为期20年的租约,在俄亥俄州建设一个8吉瓦的数据中心。英伟达将为设施残值提供高达1050亿美元的担保,并成为独家芯片供应商。该交易凸显了AI基础设施投资的巨大规模,九家科技公司持有约3万亿美元的AI承诺,但这些承诺并未出现在资产负债表中。

SynthePulse Insight阅读深度解读
A重点85
DeepTech深科技

提出“AI虚拟细胞”的团队,现在要虚拟整块组织了

瑞士洛桑联邦理工学院(EPFL)的夏洛特·邦纳团队联合多家机构推出了VirTues基础模型,旨在通过空间蛋白质组学数据构建虚拟组织表征,解决数据孤岛问题。该模型在《自然》杂志发表,展示了跨队列、跨平台的泛化能力,并在三阴性乳腺癌等应用中展现出潜力。

VirTues模型架构图:包含数据输入(空间蛋白组学图像)、数据库、编码器/解码器流程、多层级处理(分子、细胞、微环境、组织层),以及数据集统计饼图和性能对比图表。

更多

A重点78
NVIDIA Developer Blog

NVIDIA 发布 Nemotron 3.5 Lightning NVFP4 检查点,实现 4 倍吞吐量提升

NVIDIA 发布了 Nemotron 3.5 Lightning NVFP4 检查点,该检查点通过模型优化器实现,在保持精度的同时将吞吐量提升至原来的 4 倍,并将模型大小从 66 GB 压缩至 22 GB。这一进展旨在帮助开发者更高效地部署大型语言模型。

A重点81
The AI Insider

报告警告:随着超大规模企业押注化石燃料用于AI数据中心,天然气价格可能上涨两倍

能源研究公司Noreva发布新报告警告称,由于AI数据中心的需求与供应增长放缓和液化天然气出口增加相冲突,美国部分地区天然气价格可能在未来几年内上涨两倍。Meta、微软、谷歌和亚马逊等大型云服务商已承诺在得克萨斯州和路易斯安那州建设大型天然气发电厂以支持AI数据中心运营。Noreva预测某些地区天然气价格可能超过每百万英热单位10美元,远高于当前约2至4.50美元的范围,这可能推高数据中心运营成本,进而影响电价和代币定价。

黑白照片显示一座大型工业厂区,多根高耸烟囱中有一根正冒出浓烟,背景为山峦与阴云密布的天空。
A重点72
THE DECODER
3

Stripe 据报道以超过70亿美元收购AI初创公司OpenRouter

据彭博社报道,支付巨头Stripe正以超过70亿美元的价格收购AI初创公司OpenRouter,较其最新估值13亿美元大幅溢价。OpenRouter提供超过400个AI模型的访问,拥有800万用户,其CEO曾将公司描述为“AI领域的Stripe”。此次收购若完成,将显著增强Stripe在AI领域的布局。

SynthePulse Insight阅读深度解读
A重点83
机器之心

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北京大学联合阶跃星辰等机构提出TensorCast,一个统一可编程的张量生命周期管理抽象层,旨在解决大模型基础设施中张量管理碎片化的问题。该系统在达到专用系统性能的同时,能灵活实现跨系统组件的张量管理策略,在高并发多轮对话Agent场景下,首字延迟最高可降低93.2%。

系统架构图展示三个任务(Task A/B/C)在不同节点上的张量生命周期管理流程,包括Weights Lifecycle和KV Lifecycle,底部为Network & Storage Backend。
A重点81
机器之心

全球首个跨本体、多视角、多模态物理世界模型 CurrentWorld-0 发布

Current Robotics 发布了全球首个跨本体、多视角、多模态物理世界模型 CurrentWorld-0,该模型从真实数据中学习物理规律,支持多种机器人形态和力触觉预测,用于机器人模拟、学习和评测。这一模型有望解决传统物理仿真难以建模柔性物体和复杂接触的问题,为机器人提供可无限扩展的测试环境。

多画面拼接展示机器人在不同场景(如会议室、厨房)中操作的实拍视频帧,右下角小窗显示机器人3D模型与传感器数据界面。
A重点76
量子位

人形机器人自主完成11分制乒乓球对局

香港大学与超维动力团队研发的SMASH系统,使两台人形机器人能够自主完成一场11分制的乒乓球比赛。该系统集成了视觉感知、轨迹预测、动作规划和全身控制,并升级至2.0版本以支持更广泛的击球范围和自主发球。该成果将在第二届世界人形机器人运动会上展示,机器人还将与乒乓球名将同场竞技。

SynthePulse Insight阅读深度解读
A重点81
InfoQ

具身智能路线之争转向融合:VLA与“世界模型”从对立走向混搭

2026年,具身智能赛道从VLA与“世界模型”的路线之争转向“落地祛魅”和“路线混搭”。英伟达GTC上吉利、Momenta、华为等质疑VLA,而WAIC上厂商纷纷展示“世界模型+VLA”融合方案。蚂蚁灵波、面壁智能等发布新VLA模型,强调通用性和本地部署,行业共识是融合而非替代。

A重点76
Hacker News (AI filter)

Speko(YC S26)推出语音AI的OpenRouter

Speko(YC S26)推出一个为语音AI提供模型路由的平台,类似于OpenRouter,但专注于语音。它根据用户的约束条件(如准确性、延迟、成本)自动选择最佳的语音转文本、LLM和文本转语音模型组合,并解释选择原因。该平台旨在解决语音代理中模型选择繁琐且常过时的问题。

A重点78
The AI Insider

AI天气预报初创公司WindBorne Systems宣布完成3700万美元B轮融资,估值达2.5亿美元

WindBorne Systems是一家利用长航时气象气球和AI预测模型生成天气数据的初创公司,已获得由Khosla Ventures和Galvanize共同领投的3700万美元B轮融资,公司估值达到2.5亿美元。该公司计划利用新资金扩大商业业务,特别是面向使用天气数据进行市场预测的投资基金,并升级其通信基础设施和销售团队。

SynthePulse Insight阅读深度解读
A重点79
The AI Insider
3

Anthropic CEO为AI风险言论辩护,公司澄清Claude水印细节

Anthropic首席执行官Dario Amodei回应了关于其AI风险言论引发公众反对的批评,认为不信任源于更广泛的社会问题。公司还发布了关于Claude文本水印系统的博客,该系统为遵守欧盟AI法案而引入,采用SynthID-Text技术,并计划推出检测API。

SynthePulse Insight阅读深度解读
A重点79
The AI Insider
4

SpaceX正式完成以600亿美元收购AI编程初创公司Cursor

SpaceX已正式完成对AI编程初创公司Cursor的收购,交易金额为600亿美元。该交易最初于4月宣布,旨在利用SpaceX的算力基础设施和GPU集群来扩展先进AI应用。Cursor将加入马斯克旗下的AI资产组合,此前SpaceX已收购了xAI。

SynthePulse Insight阅读深度解读
A重点79
THE DECODER

AI视频市场从Sora的挫折中反弹

AI视频市场已从Sora的初期挫折中反弹,AI制作公司如Promise正在好莱坞历史悠久的制片厂附近设立业务,利用实时背景等AI工具降低电影制作成本。Netflix已在1000部作品中300部使用AI,初创公司Higgsfield估值达54亿美元。

A重点79
Import AI

Import AI 469:科学AI、RSI模拟器与扎克伯格的技术悲观主义

本期Import AI通讯介绍了DiG-bench,一个包含70个游戏的新基准,用于评估AI系统通过探索和好奇心发现环境规则的能力。该基准由牛津大学、普林斯顿大学等机构的研究人员开发,旨在衡量AI在未知环境中的直觉和创造力。

A重点76
The AI Insider

Serve Robotics 新增 Grubhub 为配送合作伙伴,并扩展至两个新城市

Serve Robotics 宣布将 Grubhub 加入其自主配送网络,在芝加哥和洛杉矶等城市提供机器人配送服务,并扩展到华盛顿特区和圣何塞等新市场。公司还推出了新的产品和基础设施,包括 Moxi 2.0 医院机器人和对话式 AI 广告产品 Characters。此举正值 Uber Eats 出售其持有的 Serve 股份,双方合作将于明年到期。

SynthePulse Insight阅读深度解读
A重点78
The AI Insider

Gravis Robotics 从软银获得2亿美元A轮融资,扩展自主重型设备平台

Gravis Robotics 是一家从苏黎世联邦理工学院分拆出来的公司,专注于为自主重型建筑设备开发物理AI系统。该公司从软银获得了2亿美元的A轮融资,用于扩大其硬件无关的控制系统Gravis Rack的部署,该系统可改装Caterpillar、John Deere等制造商的机械。这笔资金将支持招聘、全球扩张和更多自主设备的部署,凸显了建筑行业自动化日益增长的兴趣。

一台橙黑相间的履带式挖掘机在泥土地面上作业,机身上标有“400”字样,驾驶室上方装有设备,背景可见清晰的履带压痕。
A重点78
The AI Insider

Stripe据报以超70亿美元收购AI网关初创公司OpenRouter

据彭博社报道,Stripe已达成协议,以超过70亿美元收购AI模型市场OpenRouter。OpenRouter提供平台,让客户根据需求和预算在数百种AI模型之间切换,旨在避免供应商锁定。此次收购之前,OpenRouter在5月完成了1.13亿美元的B轮融资,估值13亿美元,并拥有800万用户。

A重点78
机器之心

OpenAI 内部有个神秘邮箱,小事也能惊动奥特曼

OpenAI 内部设有一个名为 friction@openai.com 的邮箱,员工可上报各种内部问题,领导团队筛选后快速处理,重要问题会直接惊动 CEO 山姆·奥特曼。该机制由应用业务 CEO Fidji Simo 制度化,旨在消除官僚主义,保持公司扩张中的行动效率。

推特截图显示Emily Forlini发帖称其为首位向friction@openai.com邮箱报告问题的人,该邮箱被比作‘Jeff Bezos式提问标记邮件’;配图是Sam Altman侧脸沉思照。
A重点78
AI前线

Bun 用 Claude 重写为 Rust,Zig 创始人批评其代码质量

Bun 的创建者 Jarred Sumner 利用 Claude AI 智能体在 11 天内将 Bun 从 Zig 重写为 Rust,耗资约 16.5 万美元。Zig 创始人 Andrew Kelley 批评该项目的编程实践,认为其缺乏质量把关。此事引发对 AI 辅助大规模代码重写的讨论。

A重点78
量子位

HelixWorld 1.0发布:实时可交互音视频世界模型,支持24FPS画面和48kHz立体声

Noiz AI联合多家机构发布了HelixWorld 1.0,这是首个实时可交互的音视频世界模型,能够以24FPS和48kHz立体声生成同步的视听内容。该模型采用原生Transformer架构,从生成之初就将画面和声音绑定,用户操作可同时影响两个模态。团队计划在未来几周内开源模型权重和代码,这将推动交互式世界模型的发展。

流程图:数据采集(真实视频、游戏捕获)→ 过滤(视觉/音频处理)→ 标注(三轨字幕、度量相机位姿)→ 训练集 → 微调子集;强调音频-视觉对齐与目的构建音频轨道。
A重点76
The AI Insider

AI代码审查初创公司CodeRabbit获1.43亿美元融资,估值达15亿美元

CodeRabbit是一家AI驱动的代码审查平台,已获得1.43亿美元融资,估值达15亿美元。本轮融资由Atomico和Smash Capital联合领投,宝马i Ventures、Datadog和Hirtle Callaghan等新投资者参投。这笔投资反映了投资者对AI编码工具广泛采用及对AI生成代码监督需求增长的信心。公司计划扩大国际业务,并为开源项目提供免费工具。

A重点74
机器之心

共生知行发布DPC技术,人形机器人驾驶卡丁车

共生知行(Symbiosis Robotics)发布新演示,展示人形机器人驾驶卡丁车,并推出Direct Perception Control(DPC)技术,该技术取消了中间运动表示,直接由视觉和任务信息生成关节动作,旨在解决分层控制中感知与全身控制脱节的问题。团队为此整理了15,010小时的具身数据。

SynthePulse Insight阅读深度解读
A重点74
钛媒体AGI

阿里出售灵犀互娱,聚焦AGI战略

阿里巴巴将游戏子公司灵犀互娱的股份出售给信宸资本,交易金额据传超过15亿美元。此举是阿里巴巴聚焦AI和AGI战略的一部分,通过剥离非核心业务来筹集资金。灵犀互娱CEO周炳枢已通过内部信确认此事,现有管理团队将继续运作。

SynthePulse Insight阅读深度解读
A重点76
机器之心

RoboScience发布轮式仿人形机器人REX G1,搭载具身大模型Visics

RoboScience机器科学于8月17日发布了其首款轮式仿人形通用操作机器人REX G1,搭载自研的VLOA架构通用具身大模型Visics。该机器人面向物流、工厂、零售及家庭等场景,具备22个自由度和±0.1mm重复定位精度,能在0.75米窄通道中作业,旨在适应真实生产环境,推动机器人从单一工序走向承接完整任务。

机器人侧面视图,关节处有绿色光效,左上角文字标注'22 DoF关节 自由度对标人体'。
A重点76
量子位

菲尔兹奖得主:AI现在主要靠「抬杠」突破重大数学猜想

菲尔兹奖得主Timothy Gowers指出,当前AI在数学领域最突出的突破往往是通过寻找反例而非正面证明来实现的。他列举了雅可比猜想、Erdős单位距离问题等案例,认为AI擅长在巨大空间中搜索特殊对象,并具备跨领域知识和低成本试错优势。

一段中文文本,提及OpenAI宣布解决多个数学和理论计算机科学问题,包括非Sofic群及Ramsey数R(3,3,...,3)的增长方式,并提到作者在2026年8月初记录此内容。
A重点74
InfoQ AI/ML/Data Eng

Grab 利用 AI 代理将机械性分析工作从 44% 降至 30%

Grab 正在使用 AI 代理自动化分析工作流,将机械性分析工作从 2 月的 44% 降至 6 月的 30%。其方法结合了代理自主性、认证数据、上下文管理和人工监督,自助分析越来越多地处理指标、数据和 SQL 请求,无需分析师干预。

深色界面的聊天窗口截图,显示名为 'ask-adw bot' 和 'Scarlet Bot' 的机器人在自动化处理数据管道任务,包含代码合并、DDL脚本执行、表结构变更等分析工作,并提及 'analytics' 类别变更,底部有 'Visi
A重点74
MIT Technology Review AI

当孩子的机器人挚友“去世”时会发生什么?

本文探讨了儿童与AI机器人伙伴Moxie之间的情感联系,以及当机器人功能退化或停止服务时,孩子们可能面临的失落感。文章通过10岁男孩Xander与Moxie的互动,展示了这种关系的变化,并提出了关于AI陪伴对儿童情感影响的思考。

A重点72
THE DECODER

AirTag揭露亚马逊为AI训练销毁稀有书籍

亚马逊被曝通过购买大量印刷书籍,将其扫描为AI训练数据后销毁,其中包括稀有书籍。这一行为通过AirTag追踪被揭露,引发对版权和文化遗产保护的担忧。

A重点72
The AI Insider

中国机器人融资综述:多家具身智能初创公司获新一轮投资

中国多家机器人及具身智能初创公司宣布获得新一轮融资,涵盖触觉传感、物理AI数据、力传感器、人形机器人和基础模型等领域。其中,ModuTech完成Pre-A轮融资,Mifeng Technology获得中国电信领投的数亿元融资,Bluepoint Touch完成D轮融资。这些投资表明中国资本正大力投入具身智能的基础设施层。

A重点72
InfoQ

Dario 发文谈 AI 信任危机,LeCun 批评其权力集中观点

Anthropic CEO Dario Amodei 在 X 上发文,承认 AI 公司未兑现承诺,导致公众信任下降。他讨论了监管与权力集中的问题,并主张通过制度约束前沿 AI 公司。LeCun 则批评其观点,认为信任危机源于权力集中。

黑色背景白色文字截图,显示Dario Amodei关于AI风险与诚实承诺的长文片段,底部标注‘6:44 AM · Aug 16, 2026 · 10M Views’。
A重点71
量子位

Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定

OpenAI研究员Tibo在X上宣布,用户现在可以通过三行配置在Codex中启用GPT-5.6 Sol的1M上下文窗口,此前该功能仅限API使用。配置方法包括在config.toml文件开头设置模型和上下文参数,或使用CLI命令。Tibo提醒长上下文会带来token消耗翻倍和性能下降,但OpenAI将选择权交给了用户。

Tibo在X平台发布的推文截图,内容说明如何在Codex中启用GPT-5.6 Sol的1M上下文窗口,并附带三行配置代码。
精选事件
45
来源
20
精选
12
更多
33
全部列表