Meta 的新 AI 图像生成器使用了 11 亿张 Instagram 和 Facebook 照片进行训练

Meta 的新 AI 图像生成器使用了 11 亿张公开可用的 Instagram 和 Facebook 照片进行训练,引发了关于版权、同意以及地区访问限制的审视。评论者指出,Meta 的条款赋予其对用户内容的广泛权利,并就基于受版权保护或用户上传材料进行训练在法律和伦理上是否可接受展开争论,尤其是在用户和照片中的人物可能并不理解或同意这种用途的情况下。其他人则关注实际层面:该工具目前仅对美国开放地区限制,相比开源替代方案有更严格的审核,并且与 Meta 更广泛的账户和产品生态系统纠缠在一起,许多人对此感到反感。

可用性、地区限制与注册流程

  • 许多用户报告在新西兰、欧盟国家(荷兰、挪威、瑞士)、加拿大、巴西、印度等地都会看到“无法在您所在的位置使用”。
  • 一些人猜测这与 GDPR / 欧盟 AI 法案或其他地区法律有关,但真正原因并不清楚。
  • 该网站常常要求用户先创建/合并 Meta 账户(Facebook、Instagram、Oculus/Horizon),随后才最终告知服务不可用,这一点被广泛批评为具有操纵性且令人困惑。
  • 访问似乎基于 IP 地理定位;即使账户设置为美国,也可能通过非美国 VPN 被拦截。

模型质量、用户体验与实用性

  • 能够访问的人表示它速度很快,质量上大致可与 SDXL 相当,但在许多提示词下仍落后于 Midjourney 和 DALL·E 3。
  • 它在手指和文本渲染方面表现明显较差;一些“高难度提示词”(物中物、非常规构图)也会像其他模型一样失败。
  • 其安全限制很强:会拒绝露骨裸露和以姓名指代的知名真人,不过通过间接提示词有时仍能生成名人相似脸。

替代方案与内容审核取舍

  • 一些评论者认为,经过强力审核、封闭式的生成器不如本地 Stable Diffusion 方案(Auto1111、ComfyUI、Fooocus 等)有吸引力,因为后者更灵活,且基本不受审查。
  • 关于哪些 SDXL 封装工具最好存在争论;观点会因使用场景和偏好的复杂度而大相径庭。

训练数据、版权与服务条款

  • 围绕是否对用户生成的 Instagram/Facebook 内容进行训练属于“版权洗白”展开了长篇争论。
  • Instagram/Facebook 的 ToS 授予 Meta 广泛的、全球范围的、可再授权的权利,以使用上传内容并基于其创建衍生作品,但并非所有人都认为用户意识到这其中也包括 AI 训练。
  • 有人认为这种训练很可能是合法的合理使用,且不构成衍生作品;也有人认为这处于法律灰色地带,并且相对于上传内容最初的用途而言是一种“偷梁换柱”。
  • 还出现了关于删除的问题:如果用户删除了一张照片,Meta 是否需要将其对模型的影响移除?大家承认这仍未解决,而且可能极其昂贵。

责任与侵权输出

  • 人们区分了训练数据的合法性与特定生成图像是否侵犯版权或商标(例如米老鼠、钢铁侠)。
  • 许多人预计,责任主要会落到发布侵权输出的用户身上,类似于使用复印机或 Photoshop,但法院目前尚未对此作出明确裁定。

隐私、伦理与用户信任

  • 有些人认为这只是“又一个”删除 Meta 账户的理由;另一些人则指出 Meta 早已做过更糟的事,因此这只是增量升级。
  • 担忧不仅限于版权,还包括被他人上传照片中所拍摄人物的权利,以及“我们自己的图像”如今被嵌入商业 AI 这一想法。

深度伪造、裸照与伤害

  • 一些评论预测或提到已有工具可以生成真人的裸照或具有把柄性质的图像;另一些人指出 Meta 的模型目前在这方面被大幅削弱。
  • 对于这件事有多新或多有害,意见分歧很大:有人说此类滥用早于现代 AI,但也承认更大的规模和更低的门槛已经增加了现实世界的伤害,尤其是在青少年和政治领域。
  • 少数人认为,广泛存在的假裸照也许最终会使社会脱敏,而另一些人则强调持续而严重的伤害。