IT之家:https://www.ithome.com/ 7 月 22 日消息,国家安全部今日发文,对于当前 AI 语音克隆技术可能存在的风险进行了警示。

得益于 AI 技术的快速发展,AI 已能在极短时间内完成对真实人声的高仿真复刻,但相关滥用行为正严重扰乱社会秩序、侵害群众财产安全。国家安全部分析了 AI 语音克隆技术的三个主要特征。

其一,采样速度极快,主流商业平台所需的最短训练样本时长已从几十分钟压缩至 3 到 5 秒。

其二,合成语音极为逼真,研究显示在无提示情况下普通人识别高质量合成语音的准确率不足 50%。

其三,操作极为简便,大批在线平台向公众开放“声音克隆”功能,普通用户上传样本即可一键生成。

وزارة الأمن القومي تحذر من ثلاثة مخاطر رئيسية لتوليف الصوت العميق بالذكاء الاصطناعي: يمكن تزوير الصوت باستخدام عينة مدتها 3-5 ثوانٍ فقط، والدقة في التعرف بالنسبة للأشخاص العاديين أقل من 50%

当声音可被随意伪造时,其承载的信任价值面临消解风险。国家安全部提示列举了三类主要风险:

个别人员恶意克隆公职人员及公众人物语音,拼接编造不实言论和虚假政策解读,通过社交媒体批量传播以误导公众认知。

国家安全部提示指出,我国已基本形成集民事保护、行业监管、刑事惩戒于一体的制度约束体系。依据《中华人民共和国民法典》,对自然人声音的保护参照适用肖像权保护有关规定,未经本人授权擅自克隆、合成、传播他人可识别语音均属侵权行为。

根据《生成式人工智能服务管理暂行办法》《互联网信息服务深度合成管理规定》等规范,深度合成语音服务提供者必须落实平台备案、用户实名、授权核验、溯源标识等合规要求。利用 AI 语音克隆实施电信诈骗、造谣抹黑、非法牟利等行为,触犯刑法的将依法从严追究刑事责任。

IT之家注:深度合成是指利用深度学习技术生成包括文本、图像、音频、视频等在内的合成内容的技术统称。