申请实习证 两公律师转社会律师申请 注销人员证明申请入口 结业人员实习鉴定表申请入口 网上投稿 《上海律师》 切换新版
当前位置: 首页 >> 业务研究大厅 >> 专业委员会 >> 数字科技与人工智能专业委员会 >> 专业论文

AI声音克隆侵权的中国法律应对——规范基础与司法探索

    日期:2026-09-23     作者:张逸瑞(数字科技与人工智能专业委员会,北京市金杜律师事务所上海分所)

 引言:中国声音保护的背景

 面对全球AI声音克隆技术的迅猛发展,中国同样面临艺人声音被非法复制、篡改和商业利用的严峻挑战。与美国依赖各州个人形象权立法不同,中国的声音保护主要根植于《中华人民共和国民法典》的人格权编,并辅以司法实践逐步细化具体规则的适用。20244月,北京互联网法院对全国首例“AI声音侵权案”作出判决,为这一新兴领域提供了重要的先例参考。本文将系统梳理中国现行法律规范,深入剖析该典型案例的裁判要旨,并在结尾对比中美实践中的共识与差异,探讨尚待解决的法律问题。

 一、中国法律对声音权益的保护框架

 我国《民法典》第1023条明确规定:“对自然人声音的保护,参照适用肖像权保护的有关规定。”这一条款首次在法律层面确立了声音作为独立人格权益的地位。根据《民法典》第1018条,肖像是指“在一定载体上反映的特定自然人可以被识别的外部形象”,其核心构成要件为“可识别性”。参照肖像权的规定,声音权益的保护前提同样是该声音具有可识别性,即第三人能够将所听到的声音与特定自然人建立对应关系。

 在权利内容方面,《民法典》第1018条赋予肖像权人对其肖像的制作、使用、公开和许可使用权。未经肖像权人同意,他人不得以发表、复制、发行、出租、展览等方式使用或者公开肖像权人的肖像。享有声音权益的权利人可比照上述规则,禁止他人未经授权擅自制作或使用、公开其声音。此外,《民法典》第1019条规定“任何组织或者个人不得利用信息技术手段伪造等方式侵害他人的肖像权。”由于AI声音克隆技术属于典型的“信息技术手段”,这一条款可以解释为权利人禁止他人未经授权利用AI克隆声音提供解释路径。

 二、全国首例“AI声音侵权案”:北京互联网法院判决详解

 2024423日,北京互联网法院对全国首例“AI声音侵权案”宣判。该案是中国首例涉及AI克隆声音的司法裁判,其事实认定和法律适用具有开创性意义。

 (一)案件基本事实

 2024423日,北京互联网法院对全国首例“AI声音侵权案”宣判。本案基本案情如下:原告殷某是一名配音师,偶然发现利用自己的声音配音的视频在平台上广为流传。经溯源,前述视频中的配音来自被告A运营的文本转语音产品。

原告曾为被告B(某传媒公司)录制录音制品,被告B对该录音制品享有著作权。后被告B将该录音制品提供给被告C(某软件公司),允许其“以商业或非商业的用途使用、复制、修改数据用于其产品及服务”。被告C将录音制品作为AI训练素材,制作生成涉案的文本转语音产品并在被告D(某云服务平台)的平台上出售。被告A与被告E(某科技发展公司)签订在线服务买卖合同,由被告E向被告C采购涉案文本转语音产品。被告A采用应用程序接口,直接调取该产品(未经技术处理)在其平台中使用。

 本案包括两个争议焦点:自然人声音权益保护范围是否及于AI声音;被告是否应当承担侵权责任。

 (二)争议焦点一:自然人声音权益是否及于AI生成的声音

 与肖像权的可识别性要求一致,北京互联网法院以可识别性作为是否应当将AI声音纳入声音权益保护范围的判断标准。《民法典》第一千零二十三条第二款规定:“对自然人声音的保护,参照适用肖像权保护的有关规定。”肖像是通过影像、雕塑、绘画等方式在一定载体上所反映的特定自然人可以被识别的外部形象。参照肖像权的规定,声音同样以具有可识别性作为法律保护的前提条件。

 法院指出,自然人的声音有独特性、唯一性、稳定性特点,“能够令一般人产生与该自然人有关的思想或感情活动,展示个人的行为和身份”。相较于肖像,声音具备无形性、不可视的特征,其识别性相对较弱,一般建立在反复多次或长期聆听特定声音的基础上,他人才能通过该声音特征识别出特定自然人。对于从事配音等特定职业的自然人,若一定范围内的听众能够将声音与该特定自然人建立一一对应关系,则可认定该声音具备识别性。

 关于经人工智能技术处理后的声音是否落入自然人声音权益保护范围,法院明确指出,关键在于通过该声音是否仍能识别出该特定自然人。只要一般社会公众或者一定范围内的公众根据音色、语调和发音风格,能够识别出特定自然人,则该自然人声音权益可及于该AI声音。

 本案中,被告C仅使用了原告一人声音开发案涉文本转语音产品,且经庭审勘验,生成的AI声音与原告的音色、语调、发音风格等具有高度一致性。因此,法院认定一定范围内的听众能够将案涉AI声音与原告本人建立一一对应的联系,原告的声音权益及于案涉AI声音。

 (三)争议焦点二:各被告侵权责任的认定与分配

 关于合法授权的认定。法院首先审查了原告是否授权被告B对外许可对其声音进行人工智能处理。依据《民法典》第一千零一十八条第一款,自然人有权依法制作、使用、公开或许可他人使用自己的肖像。比照上述规定,自然人享有依法录制、使用、公开或许可他人使用其声音的权利,有权制止他人未经许可的声音使用行为。根据《兼职配音师聘用协议》,被告B享有《穿越之凰谋天下》 录音制品的使用及许可第三方使用原告姓名、肖像的权利, 但是不包括许可第三方进行案涉的人工智能处理、生成AI声音。因此,原告未授权被告B对外许可对其声音进行人工智能处理。

 其次,关于原告是否授权被告C使用其声音。法院查明,《数据授权书》并非原告本人签署,原告本人对《数据授权书》的签署不知情亦不认可。关于代签方是否构成表见代理,法院指出,代签方曾在与被告B签署《兼职配音师聘用协议》时代理原告签署过《声明》,但该代理关系在协议履行完毕后即终止。被告C并未提交充分证据证明代签方存在代理原告签订《数据授权书》的权利外观。同时,被告C对原告声音的处理方式可能对原告的人格及财产利益产生重大影响,被告C并未就代签方有无合法授权进行合理审查,无合理理由相信代签方有权代理原告同意对其声音进行人工智能处理并开发相关产品。据此,法院认定代签方不构成表见代理。

 最终,法院认定被告BC因未经许可使用原告声音,是声音权益的共同侵权人,需承担赔偿责任。涉案产品的使用者(被告A)、云服务平台(被告D)、产品的委托采购者(被告E)因为不存在主观过错,因而不承担损害赔偿责任。但涉案产品的制作者(被告C)及使用者(被告A)需要向原告赔礼道歉。

(四)判决的深层意义

 本案首次以司法判决确认AI处理后的声音若具有可识别性,即受声音权益保护,明确了“著作权授权不等于人格权授权”的规则——享有录音制品著作权不等于有权授权他人对声音进行AI化处理。同时,法院对制作者、使用者、平台方、经销商等不同主体按过错区分责任,为后续类案提供了裁判参考,有助于在技术创新与人格权保护间寻求平衡。

 结语:展望未来的法律完善

技术发展日新月异,AI声音克隆的应用场景正从娱乐、传媒向教育、客服、医疗等领域快速渗透。法律规则必须保持动态更新,才能既激励技术创新,又防止权利滥用。我们期待未来通过更细致的立法、更丰富的判例和更广泛的行业自律,逐步构建起清晰、公正、高效的AI声音治理体系,让科技真正服务于人类福祉。