光电万象笺
4小时前来自 科技看点

删了对话≠删了文件!AI传隐私风险全揭秘

“别再给AI乱传文件了”话题近日登上热搜,核心争议在于:用户随意上传的合同、证件、内部资料等文件,可能被平台长期留存、用于模型训练或通过OCR泄露,而删除对话并不能真正清除服务器上的原始文件。

一、为什么文件上传比聊天更易泄露隐私?

存储机制不同:多数AI平台的对话记录和上传文件是分开存储的,清空前端对话框不代表服务器上的源文件被物理删除。

信息密度更高:一份合同或报表包含的姓名、手机号、金额等结构化信息,远超零散聊天记录,一旦被用于模型训练或爬取,后果更严重。

OCR自动提取文字:AI能精准识别图片中的身份证、银行卡、内部系统水印,传截图等于直接暴露明文。

连带第三方隐私:文件中常含甲方乙方联系方式、他人身份信息,上传者无权擅自披露,泄露后需承担法律责任。

二、当前舆论的两极声音

警惕派(多数认证账号、大V账号)

- 强调“删了对话≠删了文件”,且部分平台用户协议中“用于改进服务”可能包含用上传数据训练模型。- 指出即使正规平台有加密机制,后台运维人员、漏洞或黑客攻击仍可能导致数据外泄。

乐观派(部分认证账号、普通账号)

- 认为普通用户的数据对模型训练是“噪音”,主流大模型已用公开语料完成训练,不会拿用户私有文件迭代基座。- 指出存储海量用户文件需要极高成本,商业上不现实,平台没有动机冒险。

共识区域

- 对于身份证、银行卡、合同、病历、企业内部资料等极敏感内容,双方均同意不应上传云端AI。- 日常文案、翻译、公开知识整理等非敏感内容,可使用正规AI工具,不必过度焦虑。

三、实用的安全操作守则

  • 场景
  • 建议做法
  • 普通文本处理(写稿、翻译、知识问答)直接使用,无需担心
  • 含个人隐私的文件(身份证、银行卡、病历)绝对不上传,改用本地离线工具或手动处理
  • 含工作机密的文件(合同、财报、标书、源代码)不上传,或先脱敏替换姓名/金额/编号,只粘贴关键片段
  • 图片/截图先检查是否含人脸、证件、系统水印,如有则不上传
  • 必须上传的场景在本地用打码工具遮挡敏感字段,上传后立即到“文件管理”中彻底删除,不只删对话

四、法律与平台责任提示

正规AI平台受《生成式人工智能服务管理暂行办法》《个人信息保护法》约束,不得私自将用户数据用于训练,须取得明确授权。

用户自身也需注意:上传包含他人信息(如甲方乙方电话)的文件,一旦泄露,上传者可能因“未获授权处理个人信息”而担责。

五、核心自测方法

上传前问自己一句:如果这份文件现在出现在一个陌生人的电脑屏幕上,我会不会感到不安?如果回答“是”,就不要上传。