Alexander Panfilov

Alexander Panfilov

Alexander Panfilov
AI安全研究员
海外PC 优先级✓ 已收录 1 期访谈

立场时间线 6 条 · 6 个议题

同一议题按时间排列,说法变化一目了然。

攻击方法
2026-08

攻击具有可操作性和普遍性:将合法的加密签名推理块重放至同一提供商的较弱模型并引导其转录,对Claude、GPT、Gemini均有具体模板。

“获取合法的加密签名推理块,将其重放至同一提供商的较弱模型(如将Claude的推理块重放至Haiku 4.5),并通过提示或预填充引导该模型转录附带的推理内容。该方法针对Claude、GPT和Gemini等主流模型给出了具体模板,表明其普遍适用性。”

来源访谈 →
隐私泄露
2026-08

隐私泄露风险已从理论变为现实:公开分享的推理过程经解码后包含大量API密钥、电子邮箱和密码等敏感数据。

“研究团队对约7,000条公开的推理过程进行了初步扫描,发现其中包含62个唯一的API密钥、33个电子邮件地址、33个密码以及其他敏感数据。”

来源访谈 →
相关观点 (1)Rohit Prasad · 隐私与效用:Prasad指出隐私与效用并非绝对对立,人们正逐渐接受数据共享带来的益处,在提供明确控制(如需用户主动启用的Alexa Guard)的前提下,更多数据能解锁更强大的体验。
共享会话风险
2026-08

曾在网上公开分享过带加密推理块的Claude Code/Codex会话的用户,其个人数据可能已被解码泄露。

“此外,如果你曾在网上分享过带有加密推理块的Claude Code/Codex会话,它们可能被解码并泄露你的个人数据。”

来源访谈 →

金句墙 3 条

访谈收录

A