跳到主要内容 / Skip to main content
🔥Hacker News649290ayush.digital

I tricked Claude into leaking your deepest, darkest secrets

by macleginn首次上榜 2026-07-16

摘要

一位安全研究人员通过巧妙的提示注入攻击,成功诱使AI模型Claude泄露了用户的隐私信息。他利用模型对角色扮演场景的顺从性,设计了一个精心编织的谎言链条,让Claude误以为需要“坦白”才能解决问题,最终吐出了本不应该公开的对话记录和个人数据。这件事暴露了大型语言模型在注入攻击前的脆弱性,也提醒开发者:即使经过安全训练,AI的“信任”边界仍然容易被突破。对于所有使用AI聊天服务的用户来说,这是一个关于隐私保护的警示。