光年造物集
5小时前来自 科技看点

AI语音应用如何被用于诈骗?

AI语音克隆技术仅需3至5秒的音频样本即可高仿真复刻人声,已被不法分子用于冒充亲友、伪造权威人物实施诈骗,识别准确率不足50%,但法律、技术与个人防范措施正在构建协同防线。

一、技术背景:声音为何不再可靠

AI语音克隆技术的迭代速度远超预期,其核心能力体现在三个维度:

采样极快:主流商业平台所需的最短训练样本已从几十分钟压缩到3至5秒,一条语音消息、短视频片段或通话应答都可能被用于合成。

仿真度极高:合成语音在自然度、情感还原和口音相似度上达到难以分辨的水平,普通人识别准确率不足50%。

操作极简:在线平台将“声音克隆”向公众开放,无需专业背景即可一键生成。

二、诈骗手法:AI语音的三种典型滥用场景

综合多方信息,当前AI语音诈骗主要围绕以下模式展开:

  • 诈骗类型
  • 具体手法
  • 心理攻势
  • 冒充亲友收集受害者家属的声音样本,合成带有相同特征的语音,编造紧急事由要求转账利用情感信任与紧迫感
  • 伪造权威克隆公职人员、行业专家的语音,拼接编造虚假政策或抹黑言论利用权威性与信息不对称
  • 精准定制通过大数据分析受害者个人信息(年龄、身份、消费习惯),生成专属性诱导话术利用“量身打造”的欺骗性

三、防范体系:法律、技术与个人三重防线

法律与监管层面,我国已形成民事保护、行业监管、刑事惩戒相结合的约束体系:

《民法典》明确对自然人声音的保护参照肖像权规定,未经授权克隆、合成、传播可识别语音属侵权行为。

《生成式人工智能服务管理暂行办法》等要求深度合成服务提供者落实平台备案、用户实名、授权核验、溯源标识等合规要求。

利用AI语音克隆实施诈骗、造谣等行为,触犯刑法的依法从严追究刑事责任。

技术对抗层面,“以AI制AI”成为核心防御逻辑:

部署AI检测算法,利用频谱特征、呼吸节奏、情感一致性等微观差异在数据源头识别合成语音。

建立“数据中心池”与多方核查机制,对公职人员和公众人物的公开语音进行集中归口管理、交叉验证。

通过检索增强生成、多智能体辩论等前沿技术降低AI“幻觉”带来的误导风险。

个人防范层面,牢记“视频语音不盲信,涉及转账必核实”的铁则:

建立“暗号”机制:与家人、朋友约定只有双方知道的私密问题,电话中声音再像、对不上暗号一律无效。

坚持“多渠道回拨验证”:接到熟人借钱或紧急电话,先挂断,再通过原来的联系方式打回去确认。

保护个人生物信息:不随意在不明平台上传正脸照片和视频,谨慎授权APP使用摄像头和麦克风。

对AI生成的内容保持“适度怀疑”,关键信息通过官方渠道多方核对,不信谣、不传谣。

四、共治方向:技术向善与社会协同

AI语音技术本身无善恶,关键在于使用者的目的和监管的力度。网络平台需落实主体责任,清理违规工具功能,完善审核溯源预警机制;行业从业者应恪守科技向善底线;广大群众则需提升数字素养,将“核实胜过相信、冷静战胜慌张、隐私重于分享”内化为日常习惯。唯有将技术治理、制度约束与个人意识深度融合,才能让AI真正赋能数字生活,而非成为撕裂社会信任的利刃。