代码浪潮记
2小时前来自 科技看点

AI文件上传风险曝光:合同身份证或成训练素材

别再给AI乱传文件了# 话题在2026年7月22日登上微博热搜,大量用户和媒体集中讨论随手向AI上传合同、身份证、内部文件等行为背后的隐私泄露与数据安全风险,并普遍呼吁“脱敏后再上传”。

一、主流舆论关注的四大风险

文件会被服务器长期留存 绝大多数云端AI平台将对话记录与上传文件分开存储,用户手动删除聊天窗口并不等于清除了服务器上的源文件,甚至很多平台找不到彻底删除文件的入口。

内容可能被用于模型训练 平台用户协议中常见的“用于改进服务”条款,权限范围往往不明确。一份完整的合同或报表所含信息量,远大于零散输入的聊天文字,一旦被纳入训练库,隐私与商业机密将难以追溯。

连带泄露他人隐私,上传者须担责 合同、客户资料等文件中通常包含甲方乙方姓名、手机号、身份证等第三方敏感信息。未经授权擅自上传,一旦泄露,上传者本人需要承担法律责任。

图片比文字更危险 AI的OCR技术能精准提取图片中的所有文字,身份证、银行卡、人脸照片、内部系统截图上传后等同于明文公开,且图片碎片可能被AI用于后续图像生成。

二、实用的安全操作指南

  • 操作场景
  • 具体建议
  • 能粘贴就不传文件复制关键内容并做脱敏处理(如替换真实姓名、金额、证件号),再粘贴给AI处理
  • 必须上传时先本地脱敏将公司名改为“A公司”,金额改为区间,手机号替换为“XXX”,隐藏表格中的隐藏列、批注等细节
  • 用完立即彻底删除不只删对话,还要到文件管理入口手动删除源文件
  • 高度敏感文件断网处理合同、财报、病历、未公开代码等坚决不碰云端AI,改用本地部署的工具
  • 上传前进行“自检拷问”问自己“这份文件若出现在陌生人电脑上,我会不会慌?”会就立刻停止上传

三、争议焦点

有观点认为不必过度恐慌:部分声音指出普通用户的数据对大模型训练而言是“噪声”,主流平台有明确的隐私协议,企业版更签有保密合同,不应情绪化恐吓用户。

也有声音提醒不能赌概率:已出现因平台安全漏洞导致用户聊天记录、文件内容被公网曝光的真实案例,因此风险客观存在,用户不能盲目信任“上传即销毁”的说法。

核心共识:无论风险高低,身份证、人脸照片、公司内部机密等明确不可公开的信息,无论平台如何承诺,都不应主动上传给任何云端AI工具。