和 AI 聊天,你的数据安全吗?AI 隐私保护指南
你发给 ChatGPT 的内容会被拿去训练吗?哪些信息绝对不能贴?一文讲清 AI 的数据流向、不同产品的隐私差异,以及保护自己的实用做法。
编辑部 ·
很多人用 AI 时会顺手把合同、代码、客户名单、体检报告贴进去——毕竟它那么好用。但这些内容到底去了哪里?会不会被拿去训练、甚至被别人看到?这篇把数据流向和防护做法讲清楚。
你发出去的内容,去了哪里
用网页版或 App 时,流程大致是:
- 你的输入被发送到厂商的服务器(本地不做计算)
- 服务器上的模型处理并返回结果
- 对话通常会被存储一段时间(用于展示历史、安全审查等)
- 部分产品可能用这些内容来改进模型
关键在第 4 步——这也是大家最关心的。
会被拿去训练吗?分情况
大致可以分三档(具体以各家当时的官方条款为准,政策经常调整):
| 使用方式 | 一般情况 |
|---|---|
| 消费级网页/App(免费或个人订阅) | 可能默认用于改进模型,但通常可在设置里关闭 |
| 企业版 / 团队版 | 一般承诺不用于训练,合同层面有保障 |
| API | 通常默认不用于训练,面向开发者 |
| 本地开源模型 | 数据完全不出本机 |
所以:越”企业向”,隐私保障通常越强;想彻底不出门,只有本地部署。
哪些内容不该贴进去
这条清单建议记牢——贴进去就等于交给了第三方:
- 🚫 身份证、护照、银行卡、住址等个人身份信息
- 🚫 密码、API Key、私钥、Token(泄露可直接被盗用)
- 🚫 公司未公开的财务、合同、客户名单
- 🚫 他人的隐私信息(同事、客户的资料,可能涉及合规责任)
- 🚫 完整的病历、体检报告等敏感健康数据
- ⚠️ 有保密义务的工作内容——很多公司已明确禁止贴进外部 AI
保护自己的实用做法
1. 关掉「用于改进模型」开关 主流产品的设置里通常都有(名称类似”改进模型/训练”),关掉能减少你的内容进入训练集。
2. 用「临时对话 / 不保存历史」模式 适合一次性、敏感一点的问题。
3. 脱敏后再贴 把真实姓名换成「张三」、金额改成示意数字、删掉 Key。大多数时候 AI 并不需要真实数据也能给你正确的思路。
4. 重要场景走企业版或 API 有合规要求的团队,用企业版/API 比让员工各自用个人账号安全得多。参考 API 充值攻略。
5. 真正敏感的用本地模型 数据完全不出本机,代价是要显卡和运维,权衡见开源 vs 闭源大模型。
6. 企业知识库用私有 RAG 把内部资料放进自己的向量库,只在需要时检索片段,见 RAG 是什么与向量数据库。
别忽略的两个「附加风险」
小结
AI 很好用,但请记住一个朴素的原则:
凡是你不愿意发给一个陌生第三方的内容,就别贴进 AI。
做好三件事——关掉训练开关、贴之前先脱敏、敏感场景用企业版或本地模型——你就能在享受效率的同时,把风险控制在可接受范围内。