返回信息流
新闻事件
S信号89
AI前线
1 个来源

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型"套出"大模型隐藏思维链,Kimi-K3重现概率异常

一项最新研究揭示了Anthropic、OpenAI和Google的API中存在严重的安全漏洞,攻击者可以利用轻量级模型作为"解码器",从加密的推理块中恢复出顶级模型的隐藏思维链。该研究由MATS program研究员Alexander Panfilov领衔,联合马克斯·普朗克智能系统研究所等机构发布,论文阅读量已超过210万。此外,研究还发现Kimi-K3在复现Claude/GPT推理片段时概率异常高,但作者强调这不足以直接证明蒸馏。

主报道

AI前线

主报道来源