
代码浪潮记
AI文件上传风险曝光:合同身份证或成训练素材
别再给AI乱传文件了# 话题在2026年7月22日登上微博热搜,大量用户和媒体集中讨论随手向AI上传合同、身份证、内部文件等行为背后的隐私泄露与数据安全风险,并普遍呼吁“脱敏后再上传”。
一、主流舆论关注的四大风险
文件会被服务器长期留存 绝大多数云端AI平台将对话记录与上传文件分开存储,用户手动删除聊天窗口并不等于清除了服务器上的源文件,甚至很多平台找不到彻底删除文件的入口。
内容可能被用于模型训练 平台用户协议中常见的“用于改进服务”条款,权限范围往往不明确。一份完整的合同或报表所含信息量,远大于零散输入的聊天文字,一旦被纳入训练库,隐私与商业机密将难以追溯。
连带泄露他人隐私,上传者须担责 合同、客户资料等文件中通常包含甲方乙方姓名、手机号、身份证等第三方敏感信息。未经授权擅自上传,一旦泄露,上传者本人需要承担法律责任。
图片比文字更危险 AI的OCR技术能精准提取图片中的所有文字,身份证、银行卡、人脸照片、内部系统截图上传后等同于明文公开,且图片碎片可能被AI用于后续图像生成。
二、实用的安全操作指南
- 操作场景
- 具体建议
- 能粘贴就不传文件复制关键内容并做脱敏处理(如替换真实姓名、金额、证件号),再粘贴给AI处理
- 必须上传时先本地脱敏将公司名改为“A公司”,金额改为区间,手机号替换为“XXX”,隐藏表格中的隐藏列、批注等细节
- 用完立即彻底删除不只删对话,还要到文件管理入口手动删除源文件
- 高度敏感文件断网处理合同、财报、病历、未公开代码等坚决不碰云端AI,改用本地部署的工具
- 上传前进行“自检拷问”问自己“这份文件若出现在陌生人电脑上,我会不会慌?”会就立刻停止上传
三、争议焦点
有观点认为不必过度恐慌:部分声音指出普通用户的数据对大模型训练而言是“噪声”,主流平台有明确的隐私协议,企业版更签有保密合同,不应情绪化恐吓用户。
也有声音提醒不能赌概率:已出现因平台安全漏洞导致用户聊天记录、文件内容被公网曝光的真实案例,因此风险客观存在,用户不能盲目信任“上传即销毁”的说法。
核心共识:无论风险高低,身份证、人脸照片、公司内部机密等明确不可公开的信息,无论平台如何承诺,都不应主动上传给任何云端AI工具。