David Attenborough 现在在旁白我的生活
能够令人信服地克隆名人声音的 AI 工具,例如 David Attenborough 的声音,让用户惊叹不已,同时也引发了对同意、合法性和伦理的担忧。评论者争论,模仿可识别的声音是否属于版权、“公开权”或戏仿范畴,以及随着高质量语音合成变得便宜且无处不在,现有法律会如何演变。许多人看到了创意和个人用途的潜力,但也担心深度伪造、死后“数字来世”,以及对那些声音本就是其生计核心的表演者的剥削。
对演示的整体反应
- 许多人认为这个演示在技术上令人惊叹、在创意上令人愉悦;几年前看起来不可能的事情,如今已成了一个周末项目。
- 也有人觉得它令人毛骨悚然、恶心,或带有“死灵召唤”般的感觉,尤其因为它使用了一个年迈公众人物那种一听就能认出的声音。
- 还有人喜欢想象把它换成其他知名旁白者,用于制造幽默、会议场景,或小说式旁白。
伦理、法律与同意
- 关于克隆在世者的声音(尤其是某位辨识度很高的名人旁白者)是否应在未经明确同意的情况下合法,存在强烈争论。
- 一些评论者提到“公开权/人格权”不同于版权,认为即使不直接点名,利用类似名人声音获利或唤起其身份联想也可能构成可诉行为。
- 另一些人则认为:
- 人类模仿他人声音一直是合法且常见的;AI 至少在非欺骗性或戏仿用途上也应当类似对待。
- 个人的私下使用(例如给自己的人生或电子书配旁白)一般应当被允许,而商业化利用应受到限制。
- 也有人担心,任何合成声音都会像某个真实的人,因此严格监管很难定义或执行。
- 最近演员罢工以及过去关于声音相似度的诉讼,被拿来作为证据,说明对 AI 复制肖像和声音的控制正在成为一个重大问题。
- 还有人主张:当声音是模拟出来的时,必须强制披露;或者为克隆声音建立分成/授权机制。
文化与哲学方面的担忧
- 有人担心对个人的尊重会被侵蚀:克隆声音可能被用于为诈骗、宣传背书,或歪曲已故者,从而削弱信任以及我们对死亡终结性的感受。
- 也有人看到“数字来世”的潜在用途,而批评者则认为这是一种幻象,并且可能有害于我们理解人格与记忆的方式。
技术说明
- 该演示使用的是一项商业 TTS/声音克隆服务;人们讨论了其同意声明以及验证可能如何被绕过。
- 开源 TTS 工具(例如 Coqui)被提及为“够用”的替代方案,不过普遍被认为仍落后于领先的商业服务。
- 还有一些实际层面的好奇:帧是多久采样一次、视觉模型多久调用一次(例如每 5 秒一次以节省成本)。