S信号89
DeepTech深科技
1 个来源OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?
研究人员发现了一种方法,可以从Anthropic、OpenAI和Google的API中提取加密的思维链推理。通过利用加密推理块在不同会话和模型间流动的漏洞,攻击者可以让较弱的模型解码并输出旗舰模型的隐藏推理。该研究由MATS Research、图宾根大学和马克斯·普朗克智能系统研究所等机构于8月10日公开。
研究人员发现了一种方法,可以从Anthropic、OpenAI和Google的API中提取加密的思维链推理。通过利用加密推理块在不同会话和模型间流动的漏洞,攻击者可以让较弱的模型解码并输出旗舰模型的隐藏推理。该研究由MATS Research、图宾根大学和马克斯·普朗克智能系统研究所等机构于8月10日公开。
主报道
主报道来源