“耳听”可能真的“为虚”

AI语音技术克隆伪造声音需警惕

国家安全部日前发布安全提示,当前人工智能浪潮奔涌向前,AI语音克隆作为深度合成技术的重要分支,在有声读物、无障碍服务、智能语音播报等领域释放创新价值,为数字生活添便利、为产业发展赋动能。但网络黑灰产低成本复刻他人声纹、伪造语音实施诈骗、恶意合成虚假言论等乱象滋生,严重扰乱社会秩序、侵害人民群众财产安全,值得高度警惕。

声音不再是唯一标识

语音合成技术并不新鲜,但近年来相关技术更新迭代非常迅速,早期的语音合成系统只能生成机械感强烈的“电子音”,而今天的AI语音克隆技术已能在极短时间内完成真实人声的高仿真复刻。

■极为快速的采样速度。主流商业平台所需的最短训练样本时长已从几十分钟压缩到3至5秒。这意味着,一条随手发出的语音消息、一段短视频里的人声片段、一通电话的简短应答,都可能被用来合成任意内容的仿冒语音。

■极为逼真的合成语音。当前语音克隆结果的自然度、情感还原度和口音相似度,已达到让人难以分辨的水平。研究显示,在没有任何提示的情况下,普通人识别高质量合成语音的准确率不足50%。

■极为简单的使用操作。目前一大批平台将“声音克隆”功能向公众开放,普通用户无需专业技术背景,上传样本即可一键生成,操作与发送一条语音一样简便。

滥用技术滋生风险

当声音可能被随意伪造时,它所承载的信任价值将面临被消解的风险。从个人财产损失到公众舆论失真,语音合成技术的滥用正滋生一系列新风险。

■冒充亲友,实施诈骗。不法分子会通过收集受害者家属、好友的声音样本,合成带有对方声音特征的语音,编造车祸、疾病等紧急事由实施诈骗。由于声音高度相似,受害者很容易上当受骗。

■克隆声纹,侵犯权益。国内多个平台出现了利用AI伪造影视明星、运动冠军、知名专家声音的音视频,内容涉及商业广告、视频配音、自媒体引流等,此类行为直接侵犯了自然人法定声音权益。

■伪造语音,扰乱舆论。个别别有用心之人恶意克隆公职人员、行业权威及其他公众人物的语音,拼接编造不实言论、虚假政策解读、恶意抹黑话术,通过社交媒体批量传播,企图煽动网络舆情,误导公众认知,影响社会稳定。

据央视新闻