# 国家安全部警示AI语音深度合成三大风险：3-5秒样本即可伪造声音，普通人识别准确率不足50%

- 来源：IT之家（RSS）
- 发布时间：2026-07-22 08:58
- AIHOT 分数：60
- AIHOT 链接：https://aihot.virxact.com/items/cmrvfcrp201kvbihb7kic2dxa
- 原文链接：https://www.ithome.com/0/979/841.htm

## AI 摘要

国家安全部发文警示AI语音克隆技术风险，指出主流平台最短训练样本已压缩至3到5秒，无提示下普通人识别高质量合成语音准确率不足50%。不法分子利用该技术伪造亲友声音实施诈骗、克隆名人声音用于商业广告、恶意拼接公职人员语音散布虚假言论。我国已形成民事保护、行业监管、刑事惩戒制度体系，深度合成服务提供者须落实平台备案、用户实名、授权核验等合规要求。

## 正文

IT之家 7 月 22 日消息，国家安全部今日发文，对于当前 AI 语音克隆技术可能存在的风险进行了警示。

得益于 AI 技术的快速发展，AI 已能在极短时间内完成对真实人声的高仿真复刻，但相关滥用行为正严重扰乱社会秩序、侵害群众财产安全。国家安全部分析了 AI 语音克隆技术的三个主要特征。

其一，采样速度极快，主流商业平台所需的最短训练样本时长已从几十分钟压缩至 3 到 5 秒。

其二，合成语音极为逼真，研究显示在无提示情况下普通人识别高质量合成语音的准确率不足 50%。

其三，操作极为简便，大批在线平台向公众开放“声音克隆”功能，普通用户上传样本即可一键生成。

当声音可被随意伪造时，其承载的信任价值面临消解风险。国家安全部提示列举了三类主要风险：

不法分子收集受害者家属声音样本合成语音，编造紧急事由实施诈骗；

国内多个平台出现利用 AI 伪造名人声音的音视频，用于商业广告、自媒体引流等，直接侵犯自然人法定声音权益；

个别人员恶意克隆公职人员及公众人物语音，拼接编造不实言论和虚假政策解读，通过社交媒体批量传播以误导公众认知。

国家安全部提示指出，我国已基本形成集民事保护、行业监管、刑事惩戒于一体的制度约束体系。依据《中华人民共和国民法典》，对自然人声音的保护参照适用肖像权保护有关规定，未经本人授权擅自克隆、合成、传播他人可识别语音均属侵权行为。

根据《生成式人工智能服务管理暂行办法》《互联网信息服务深度合成管理规定》等规范，深度合成语音服务提供者必须落实平台备案、用户实名、授权核验、溯源标识等合规要求。利用 AI 语音克隆实施电信诈骗、造谣抹黑、非法牟利等行为，触犯刑法的将依法从严追究刑事责任。

IT之家注：深度合成是指利用深度学习技术生成包括文本、图像、音频、视频等在内的合成内容的技术统称。

国家安全部提示还提出多方协同共治要求：网络平台须落实主体责任，清理违规工具功能，完善审核溯源预警机制；行业从业者应恪守科技向善底线；广大群众应增强防范意识，谨慎保护个人声纹信息，涉及资金及隐私核验时务必进行多重验证，遇侵权诈骗应及时留存证据并举报维权。
