上周三晚上,做短视频的老徐在电脑前坐了快两个小时。他给一条两分钟的视频配旁白,自己录了三遍,都不满意,最后点开了一个 AI 配音的网页。
他贴进去一段文字,挑了一个男声,点生成。三秒,声音出来了。低沉,干净,停顿的位置也合他的意。
他把这段音频发到工作群里,说这个省事。
群里安静了几分钟。
他没回。
过了几分钟,群里有人回,这声音怎么听着有点耳熟。
老徐又听了一遍,没听出是谁。可那种耳熟的感觉,让他心里有点不太舒服。
这句耳熟,他记了两天。
谁也没说破。

10 月 2 日,据法新社报道,东京一家法院审完了一个案子,原告是声优津田健次郎。
他做配音三十多年,配过电影、动画和游戏。很多人的童年里都有他的声音,只是当时不知道名字。他最有名的一个角色,是《游戏王》里的海马濑人,那种低沉的念白,一句话就能把人拉回放学后的下午。这次他站出来,问的是一整套把声音当原材料的流程,到底算不算越界。
他说,一个匿名的 TikTok 账号从 2024 年 7 月到去年下半年,发了一堆视频,旁白是用 AI 克隆出来的他的声音。那个账号一度有二十多万粉丝。
法院认可了他的部分主张,认定未经本人许可使用其声音,属于侵犯形象权。这是日本第一次审理这一类案子。
第一次。
不过他要平台下架视频的请求,法院没有支持。原因是那个账号已经注销了。
他没再问下去。
对方说,那只是一般的男声
TikTok 在庭上的说法是,视频里用的只是一般男性声音,是不是真的像津田健次郎,本身就有争议。两边各说各的,最后是法官从音色、停顿和语气里,认定了那是模仿。
津田健次郎这边的说法是,那段旁白有他特有的低沉和厚度,听得出是对他本人的模仿。他的律师团队还提了一点,涉事账号能涨到二十多万粉,靠的就是用一副专业声优的嗓子,去给那些可疑又低俗的内容配音,听感新鲜。

这个案子的分量,不在赔多少钱。它在日本的司法里第一次把话说明白,人的声音不是谁的免费素材。
声音这件事,以前很少有人较真
脸被偷,你能看出来。名字被冒用,你能去查。声音不一样,它平时不出现在纸面上,你很难说清哪一段是你的。
可它天天在被人拿走。你在客服电话里说过的那句你好,你在短视频里随口念的一句台词,你在语音里跟朋友抱怨的那两分钟。这些片段散在各自的手机里,谁也没法把它们拼回去,更没人会想到去主张什么。等到它们被合成一段新的声音,再发到网上,你甚至无法证明那原本是你的。
还有更具体的。几十秒的素材,就能合成一段像模像样的声线。有人拿这个去骗家里的老人,电话那头是子女的声音,说钱不够了,先转点过来。

为什么归到形象权里
日本这次没有新造一个词,用的是形象权。这个口子开得不小,它意味着声音和长相一样,是可以被本人主张的一种东西。
日本政府在推 AI,动画和声优行业却在担心。去年,日本方面曾要求 OpenAI,不要用侵犯版权的方式,把被称作不可替代珍宝的动画和漫画内容拿去训练模型。

现在能做的三件事
第一件,签东西之前看清楚。App 的授权、平台的条款、录节目的协议,凡是写着可以用来训练模型的,多停两秒再点。
第二件,自己的声音留个底。重要的音视频原文件存好,什么时候录的、给谁用过,记一下。真出事那天,这些就是材料。
第三件,把这条转给家里老人。接到说自己是子女、声音又像的电话,先挂掉,再打回本人号码确认一遍。这一步花不了一分钟,能挡掉的事不小。

判决书还没全文公开。老徐后来把那段 AI 配音删了,换回自己的声音,又录了一遍。
没有下文。

你听过很像真人的 AI 声音吗,当时是什么感觉。