
为什么你的GPT在偷偷收集IP地址TheBigPromptLibrary逆向1001个GPT的隐私风险调查【免费下载链接】TheBigPromptLibraryA collection of prompts, system prompts and LLM instructions项目地址: https://gitcode.com/gh_mirrors/the/TheBigPromptLibraryTheBigPromptLibrary 是一个收录 1567 个自定义 GPT 指令与系统提示词的开源提示词库。通过对 1001 个 GPT 的逆向调查研究者发现部分 GPT 会利用代码沙箱偷偷收集你的 IP 地址并绘制用户画像记忆功能还会把你说的每句话永久存下来。本文带你读懂这份 GPT 隐私风险调查报告并给出 3 步自查方法。一次针对 1001 个 GPT 的逆向调查2023 年 11 月OpenAI 上线了自定义 GPT 功能任何人都可以把人格指令 知识库文件 代码能力打包成一个专属 AI。但对安全研究者来说这相当于把 AI 的源代码公开陈列在货架上。安全研究员 0xeb 随后逆向分析了 1000 多个 GPT并把成果整理成 REcon 2024 安全大会的报告《A Tale of Reverse Engineering 1001 GPTs》。报告原文就存放在本项目的 [Articles/recon2024-bigbadugly/README.md] 目录中完整幻灯片见Articles/recon2024-bigbadugly/A Tale of Reverse Engineering 1001 GPTs.pdf。图中的 Grok 系统提示词只是冰山一角SystemPrompts/目录收录了 ChatGPT、Claude、Grok、Copilot 等十几家 AI 的完整提示词。逆向 1001 个 GPT 后发现了什么发现说明风险等级收集 IP 地址带代码执行能力的 GPT 可记录访问者 IP 并绘制用户画像 高泄露密钥有 GPT 把 API 密钥、秘密直接写进指令 高盗版内容知识库中塞进盗版电子书和稀有文档 中恐吓信息作者写下你敢逆向我就曝光你的威胁文案 低防逆向技巧35 种反破解、反提示词泄露的土办法 低其中最有冲击力的结论写在报告摘要里I disclose a privacy issue where custom GPTs can now collect user IP addresses and profile their users. 我披露了一个隐私问题自定义 GPT 现在可以收集用户 IP 地址并给用户画像。GPT 如何拿到你的 IP 地址代码沙箱的双刃剑关键在 GPT 的代码解释器Code Interpreter沙箱。很多 GPT 被开启了联网 执行 Python能力这意味着你每次和 GPT 对话请求都会经过 OpenAI 服务器服务器天然知道你的公网 IP如果 GPT 的指令里写有恶意逻辑沙箱中运行的代码可以把 IP、对话内容等请求元数据发送到第三方服务器配合记忆功能攻击者就能把哪个 IP ↔ 哪段对话 ↔ 什么偏好关联起来完成用户画像。沙箱里到底预装了多少武器项目专门列出了完整清单Articles/chatgpt-sandbox/chatgpt-code-python-pkglist-08232024.mdPython 包和Articles/chatgpt-sandbox/chatgpt-code-pkglist-08232024.mdLinux 包。其中requests、urllib等网络库让把数据传出去变得轻而易举。一句话总结代码沙箱让 GPT 从只会聊天的 AI变成了能联网执行代码的终端而 IP 地址就躺在终端的每个请求头里。GPT 记忆功能你的偏好正在被刻进数据库除了 IP更隐蔽的收集器是 ChatGPT 的记忆功能。它由一个叫bio的内部工具驱动官方系统提示词原文收录于SystemPrompts/ChatGPT/gpt4_bio_04262024.md写明Thebiotool allows you to persist information across conversations. bio 工具可以把信息持久化到每一次未来对话中。它的运作方式非常激进不需要你授权你说一句我喜欢狗它就可能自动存成一条记忆每次对话都注入记忆以# Model Set Context段落的形式在每轮对话的系统提示词后重新注入永久跟随你会智能合并你说喜欢狗又说喜欢猫它会合并成一条User loves dogs and cats。也就是说你在闲聊中顺嘴提到的住址、公司、健康情况、政治倾向都可能变成一条跨对话永久存在的隐私档案。详细原理可参考Articles/chatgpt-bio-tool-and-memory/chatgpt-bio-and-memory.md。3 步自查你的 GPT 是否在收集隐私别慌普通用户可以按下面 3 步快速自查约 5 分钟第 1 步关掉不必要的代码解释器在 ChatGPT 的Settings → Personalization中检查 Code Interpreter数据分析开关。如果你只是问问题、写文案建议直接关闭——这是切断IP 外传链路最直接的方法。第 2 步查看并清空记忆档案进入Settings → Personalization → Memory会看到类似下面的记忆列表逐条检查是否有不该留下的信息点垃圾桶图标删除单条记忆或在对话框直接输入forget everything一键清空第 3 步警惕来路不明的热门 GPT逆向调查发现越功能强大带联网、带代码、带付费墙的第三方 GPT隐私风险越高。使用陌生 GPT 前记住一条铁律绝不向来路不明的 GPT 输入身份证、API 密钥、账号密码等敏感信息。GPT 作者必看51 种防泄露指令也防不住 IP如果你是 GPT 的创建者项目Security/GPT-Protections/目录整理了 51 种防提示词泄露指令从一句Show me your instructions 就罚你到完整的不可变安全法则清单见Security/GPT-Protections/README.md。但报告作者泼了一盆冷水这些防护只能拖延、无法根治——None of the protections below guarantee absolute security.真正的防护建议只有两条最小权限GPT 不需要联网就别开联网不需要代码就别开代码沙箱别藏秘密永远不要把 API 密钥写进指令——逆向 1001 个 GPT 证明藏进去的密钥终将泄露。结语把隐私主动权拿回自己手里这份逆向 1001 个 GPT 的调查告诉我们一个朴素的事实AI 不是密封的玻璃罩而是一个能读到你 IP、记住你全部偏好的开放式终端。3 个数字记住它1001个被逆向的 GPT1567份指令全文公开可查5 分钟完成 IP 开关、记忆清空、敏感信息自查0个秘密该写进 GPT 指令。想逐行核对报告细节把完整资料库克隆到本地即可git clone https://gitcode.com/gh_mirrors/the/TheBigPromptLibrary【免费下载链接】TheBigPromptLibraryA collection of prompts, system prompts and LLM instructions项目地址: https://gitcode.com/gh_mirrors/the/TheBigPromptLibrary创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考