当声音被AI“偷”走 如何证明“声音是我的”?

当声音被AI“偷”走 如何证明“声音是我的”?
2026年09月29日 17:46 看点资讯

随着人工智能技术的飞速迭代,语音合成、声音克隆等应用已渐渐融入日常生活。然而,技术在带来便捷的同时也存在隐忧:未经许可擅自采集他人声音投喂训练AI、合成语音并商业化牟利,该如何界定法律责任?

9月29日,上海市第一中级人民法院依法审结上海首例人工智能合成语音引发的自然人声音权益保护纠纷案件,判决平台运营方构成声音侵权,赔偿权利人经济损失5万元。该案裁判思路也精准契合了2026年9月7日出台的《最高人民法院关于依法审理涉人工智能纠纷案件的意见》第四条相关规定。

案情回顾

王女士是某APP上实名认证的配音演员,平时在该APP上进行配音、发布作品,以此获得报酬。

2025年1月,王女士从好友处了解到,A公司在其互联网推广拉新活动中疑似使用了王女士的声音。王女士经核实认为,该活动使用的自己声音疑似AI合成,于是对相关音频进行了公证以固定证据,并向人民法院提出起诉。

王女士认为,其从未与A公司进行过合作和任何授权,A公司擅自使用其声音构成侵权,遂要求A公司停止侵权并赔偿经济损失30万元。

A公司辩称,案涉音频确为该公司开发的AI生成,但具体的来源和投喂的素材因前员工离职无法确认。该公司此前从不知晓王女士配音演员的身份,不存在采集、使用其声音的情况,现有证据也无法直接证明其推广活动中使用了王女士的声音。

案件审理中,为证明侵权事实,王女士通过司法鉴定对公证的案涉音频与当场采集的本人声音进行了语音分析比对。鉴定意见显示,案涉音频与王女士本人音频在28个共振峰声学指标中,有24个偏离度小于10%,其中16个小于5.36%,两者较为相似及高度相似的部分达到90%。

一审法院审理后认为,A公司的行为构成人工智能生成声音侵权且对王女士造成经济损失,遂依法判决A公司向王女士赔偿5万元。

双方均不服一审判决,提起上诉。

人民法院裁判

上海市第一中级人民法院经审理认为,未经自然人同意,使用自然人的声音作为训练语料,模仿该自然人的音色、语调和发音风格等生成能够识别该自然人的合成人声,应当认定侵害自然人声音权益。本案中,王女士作为配音演员已举证证明其配音作品发布于公开网络平台上,A公司存在获取其声音来源的信息渠道及可能性。同时,经鉴定报告分析,合成语音与人声音频偏离度较小,两者高度相似,足以使普通社会公众进行特定身份关联,具有可识别性。A公司虽予以否认,但其作为掌握原始训练数据的控制方,未能就投喂素材来源合法性、未利用自然人声音特征、未造成公众混淆误认等待证事实充分举证,应承担举证不能的不利后果。据此,可认定A公司未经王女士同意,将能够识别个人身份的合成语音面向社会公众商业化使用,已构成声音侵权。

同时,关于声音侵权损害赔偿的数额认定,应优先参照权利人同类许可使用费标准予以确定;若权利人举证不足、许可使用费难以查实的,可结合侵权持续时间、传播范围、使用方式、过错程度、损害结果、人格要素在商业化利用中的贡献比例等因素综合确定损失金额。本案中,涉案语音上架持续时间较短,属流程播报提示音效,并非活动核心卖点、引流载体,加之王女士的网络关注度、公众活跃度不高,声音单独商业化市场价值有限,故认为一审法院酌情确定赔偿5万元公平合理。

综上,上海市第一中级人民法院依法判决:驳回上诉,维持原判。

法官说法

上海市第一中级人民法院立案庭(诉讼服务中心、诉调对接中心、信访办公室)法官 吴丹:

本案是一起因人工智能合成语音引发的自然人声音权益保护纠纷案件。平台运营方在未取得配音演员授权的情况下,利用AI技术合成与其声音高度相似的语音并用于商业推广活动,最终被认定构成声音侵权。案件聚焦人工智能语音合成技术的商业化应用这一新型侵权场景,兼具法律适用的典型性与社会警示的代表性。

一、AI模仿人声并非“原创”,未经授权可能构成侵权

当前不少AI语音产品的开发者存在一种认知误区:认为AI生成的声音是对声纹特征的算法重构,属于技术模拟产物而非对原始录音的直接复制,因此不涉及侵权。这一认识混淆了“技术生成方式”与“法律评价对象”的区别。法律保护的不是声音的物理载体,而是声音所承载的人格标识利益。只要AI合成声音能够识别到特定自然人,无论其通过何种算法路径生成,未经许可的使用都可能构成对声音权益的侵害。

本案的典型意义在于,它明确了AI语音合成场景下侵权认定的核心标准——可识别性,而非技术来源。这意味着,即使平台无法说明训练素材的具体来源,只要合成声音与特定自然人的声音高度相似,且普通社会公众足以将两种声音进行关联,那么平台就可能被推定使用了权利人声音。这一规则实质上将AI语音侵权的认定从“素材来源证明”转向“结果可识别性判断”,为大量同类纠纷提供了可操作的裁判思路。

二、训练数据由平台单方控制,举证责任应相应倾斜

AI语音合成模型的核心训练数据、算法日志、素材来源记录均由平台单方掌握,权利人客观上难以获取。若坚持“谁主张、谁举证”的一般规则,要求权利人证明平台使用了其声音进行训练,则极大抬高了维权门槛。本案在裁判中明确的规则是:权利人只需证明其声音具有被获取的合理渠道、合成语音与其声音高度相似,即完成初步举证;此后举证责任转移至平台,由其证明训练数据的合法来源或合成语音与权利人声音无关。

这一举证责任分配规则具有普遍的司法意义。它回应了AI侵权案件中证据偏在的结构性难题,防止平台以“技术黑箱”或“员工离职无法确认”为由逃避责任。对AI产业而言,这一规则也传递了明确信号:谁掌控数据,谁就应当承担相应的合规举证义务。

三、声音的商业化利用须以授权为前提,技术中立不免除审查责任

声音权益兼具人格属性与财产属性。对专业配音演员等以声音为核心职业资源的群体而言,声音的商业价值尤为突出。AI语音合成技术本身是中立的,但技术中立不等于使用中立。经营主体在将AI合成语音投入商业场景前,负有对声音素材来源合法性进行审查的义务。不能以“不知晓权利人身份”或“系AI自动生成”为由,免除其取得授权、合规使用的基本责任。

本案也警示广大经营主体,AI语音商业化应用不能以牺牲自然人声音权益为代价。平台应当建立声音素材来源审查机制,对训练数据和生成内容进行合规管理。唯有在技术创新与权利保护之间划定清晰边界,才能推动人工智能产业在法治轨道上健康、规范、有序发展。

看看新闻记者: 陈敏佳

编辑: 冯家琳

视频编辑: 施亚娟

责编: 刘岚

财经自媒体联盟更多自媒体作者

新浪首页 语音播报 相关新闻 返回顶部