光电寻常栈
7-27 08:21来自 科技看点

AI真的会偷偷记录并利用用户的隐私数据吗?

AI确实具备记录用户输入的数据并将其用于模型训练的技术能力,但正规平台通常会采取加密传输、访问控制和隐私协议来降低风险,用户是否“被泄露”更多取决于平台的数据管理政策与个人的使用习惯。

一、AI处理用户数据的基本流程

用户发送一条消息给AI,大致经历三个步骤:安全传输、平台处理、结果返回。正规的AI平台通常采用加密传输技术,降低数据在传输过程中被窃取的风险,但数据到达服务器后,是以明文形式被模型理解的。平台是否保存聊天记录、如何使用这些数据,取决于隐私政策和用户设置。

二、数据被“记录”与“利用”的两种主要方式

1. 聊天记录被服务器留存

绝大多数公共AI平台会将用户上传的文字、图片、文件等保留在服务器上,即使本地删除对话,云端仍可能完整留存。部分平台会默认开启“帮助改进模型”选项,将用户对话用于模型训练,用户需手动关闭。

2. 数据可能被用于模型训练或人工审核

一些平台设有“人在回路”机制,即用户对话和上传内容可能被后台人工审核人员看到。此外,训练完成的AI模型是一个“黑盒子”,一旦数据进入训练集,几乎无法追溯和剔除。

三、已发生的真实风险案例

1. AI误将他人隐私返回给用户

有用户使用Kimi翻译图片时,竟收到了陌生人的完整简历(含姓名、电话、邮箱)。原因是会话隔离失效,导致数据在多个用户之间乱窜。这一事件直接证明:用户上传的敏感信息确实以明文形式存在于服务器上,且存在被错误分发的可能。

2. 美国法律判例敲响警钟

美国一金融公司前董事长在正式聘请律师前,使用Claude分析法律风险并拟定辩护策略,FBI随后依法搜查并获得了31份对话记录,法院认定这些内容不具备律师-客户保密特权。法官指出:AI不是律师,注册时用户已同意数据可用于训练且可向监管机构披露。

3. 深度伪造诈骗利用用户影像

诈骗分子仅凭一张照片和5秒音频,即可通过AI换脸和语音克隆技术,在视频会议中冒充多人实施诈骗。某跨国企业财务人员因此向虚假账户转账2亿港币。这说明上传的人脸、声音数据一旦被平台留存或泄露,可能被用于犯罪。

四、如何保护个人隐私:安全使用建议

选择正规、可信的AI平台,优先使用端侧处理能力强的设备,确保数据在本地完成计算。

使用前阅读隐私政策,关闭“帮助改进模型效果”“个性化推荐”“记忆”等功能,避免数据用于训练。

对敏感内容做匿名化或脱敏处理,例如抹去身份证号、银行账号、公司名称等关键信息后再发给AI。

拒绝上传包含清晰人脸、家庭住址、定位信息的照片和视频;遵循“不敢发到朋友圈的信息,就别发给AI”的原则。

每次使用后及时清空对话记录,并定期检查AI助手的权限设置,关闭非必要的短信、通话记录、位置等高敏权限。

在工作中处理涉密或商业机密文件时,应使用离线专用设备,严禁上传至联网AI工具。

五、官方与行业的主流安全建议

中国电信客服在反诈微课堂中明确指出:个人信息、商业机密等敏感信息切勿上传,需牢记安全使用技巧。国家安全部也发布警示,翻译软件等云端应用存在泄密隐患,用户应严守“涉密不上网,上网不涉密”的原则。多家手机厂商已实现语音指令的端侧处理,并建议用户主动管理权限,避免数据外流。