科技观察窗
8小时前来自 科技看点

哪些AI平台会缓存用户照片用于训练?

一、主要AI平台的数据留存机制

1. 国内公共AI平台

普遍规则:绝大多数国内公共AI平台会缓存用户上传的图文影像,部分平台在用户协议中包含“用于服务优化与模型迭代”的条款,这意味着上传内容可能在用户不知情下被纳入训练数据库。

法规要求:受《中华人民共和国网络安全法》第二十一条约束,互联网服务提供者必须留存用户网络日志不少于6个月,后台备份不会因前端删除而立刻消失。

2. OpenAI (ChatGPT)

数据开关:关闭“为所有人改进模型”设置后,聊天内容不再用于训练,但仍保留在历史记录中。

临时聊天:使用Temporary Chat功能时,对话不参与训练,并在30天内自动删除。

文件存储分离:保存到Library中的图片和文件与普通聊天记录分开管理,删除对话不等于删除Library中的文件。

3. Google (Gemini)

数据保留:关闭“保持活动记录”后,会话内容仍可能最多保留72小时,用于提供服务和处理反馈。

默认设置:谷歌搜索服务中的视觉搜索和语音搜索默认勾选“保存并用于AI模型训练”,即使用户关闭该选项,已进入训练流程的数据仍会最多保留4年。

4. 免费AI工具

防护差异:部分免费工具的隐私防护相对较弱,缺乏完善的数据保护机制,且免费用户的文件保留时间往往更长。

二、数据留存的核心风险点

1. 存储分离机制

绝大多数云端AI平台的对话记录和上传文件是分开存储的。

手动删除前端对话框只是清除了展示,原始文件依然长期留存在服务器中。

很多平台难以找到彻底删除文件的入口。

2. 信息提取能力

AI具备强大的图文识别(OCR)能力,能精准提取图片中的所有文字。

照片背景里的小区、证件边角、出行路线等不易察觉的隐私线索都会被捕捉。

身份证、银行卡、内部系统截图一旦上传,等同于直接公开明文信息。

3. 第三方隐私连带

文件中常包含甲方、乙方的手机号、身份证号等第三方隐私。

用户无权擅自将其上传至第三方AI平台,一旦泄露需由上传者个人承担法律责任。

4. 条款模糊风险

平台条款中“用于改进服务”的模糊表述,在法律上可能包含将用户上传的文件用于模型训练。

一份合同或报表的信息密度远超百句日常对话。

三、安全使用建议

1. 绝对不传的内容

身份证、银行卡、护照等带唯一编号的证件。

医疗报告、体检单等健康隐私。

公司核心商业机密。

2. 上传前的脱敏处理

在本地裁剪掉无关区域,对关键信息进行打码或替换处理。

能用文字描述的内容就不要上传原图。

3. 使用后及时清理

完成操作后,在平台设置中手动删除上传的历史记录和文件。

优先选择支持关闭训练、短期保存或本地处理的合规工具。

4. 警惕看似无害的互动

测肤质、AI写真生成、童年照修复等娱乐小程序,若要求上传高清正脸照,需格外谨慎。

避免生物特征数据被过度收集。