RecodeX 重构消息,研究人员发现一种方法,可提取Claude、GPT和Gemini的隐藏思维链。该方法将旗舰模型的加密推理块重放到较弱的兄弟模型,并通过越狱诱导其逐字转录推理。扫描公开仓库中超31.5万个泄露的推理块,发现数百个暴露的API密钥、密码及模型不应显示的自我指涉语言。
研究曝新攻击:可窃取Claude、GPT和Gemini隐藏推理
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源Startupfortunestartupfortune.com
查看原文 ↗RecodeX 重构消息,研究人员发现一种方法,可提取Claude、GPT和Gemini的隐藏思维链。该方法将旗舰模型的加密推理块重放到较弱的兄弟模型,并通过越狱诱导其逐字转录推理。扫描公开仓库中超31.5万个泄露的推理块,发现数百个暴露的API密钥、密码及模型不应显示的自我指涉语言。