关于被列为作品用于训练 Midjourney 的艺术家

像 Midjourney 和 OpenAI 的模型这样的生成式 AI 工具,正在引发艺术家的强烈反弹,因为他们的作品似乎在未经同意的情况下被抓取并用于训练商业系统。评论者争论这究竟是受保护的“合理使用”,还是会损害生计的大规模版权侵权,并指出科技公司对他人知识产权与对自己模型权重和输出的处理方式存在不对称。更广泛的担忧包括权力向少数主导平台集中、人类创意职业被掏空的风险,以及怎样的许可、监管或开放替代方案——如果有的话——才能让 AI 辅助艺术在伦理和经济上都可持续。

AI 训练对艺术的影响范围

  • 对于使用网上艺术作品训练模型,是否类似人类学习,还是一种本质不同、工业规模的复制,存在明显分歧。
  • 一方认为:训练等同于“阅读”或“观看”;模型存储的是模式,而不是作品本身;这应当属于合理使用,如果使用本身并不侵权,那么输入是否有许可并不相关。
  • 另一方认为:模型以及其输出都是训练集的衍生作品,尤其是在它们能够输出几乎逐字逐样的图像或文本时;这应该触发版权义务。

合理使用、法律与未决问题

  • 反复强调,在这一语境下,合理使用在法律上仍未定论;多个因素(商业意图、市场损害、替代程度)都可能导向不同结论。
  • 争论公司规模或利润在法律上是否重要(大多数人认为不重要)与在道德上是否重要(很多人认为重要)。
  • 有人认为,即使训练本身被允许,具体的侵权输出(几乎完全相同的 NYT 文本、被复制的图像)也不应被允许。

公司行为与虚伪

  • 对大型 AI 公司有强烈批评:它们一边以合理使用为由抓取他人作品,一边却对自家模型和输出施加限制性许可。
  • 有人认为,如果抓取模型属于合理使用,那么基于这些模型的输出/权重来训练竞争对手也应该属于合理使用;否则就是单向的“既要吃蛋糕又要把蛋糕吃掉”。

艺术家生计、同意与剥削

  • 许多发帖者关注的是失去同意和无偿劳动:如今把作品发布到网上,实际上就等于在没有选择或补偿的情况下帮助训练商业模型。
  • 有人担心生成式 AI 会取代插画师、游戏美术以及其他视觉岗位,尤其是在低成本、高产量的场景中(书封、素材图、儿童读物、营销图片)。
  • 也有人反驳说,这些工具主要是在增强艺术家能力,而这种担忧类似于早先对摄影、印刷和录制音乐的恐慌。

关于 Midjourney 和 “Cat and Girl” 的具体情况

  • 多位用户尝试生成“像这部漫画风格”的图像;多数报告称 Midjourney 表现很差,除非经过定制训练,而且常常把“Cat and Girl”当作普通名词处理。
  • 有人因此认为,这部漫画所描述的威胁,就这位特定艺术家而言,在技术上目前还并不存在;也有人回应说,更广泛的系统性问题依然成立。

可能的补救措施与未来

  • 建议包括:对训练数据付费许可、只使用公共领域数据的模型、仅用明确授权素材训练的模型,或要求基于公共数据构建的模型开放权重。
  • 更激进的观点包括:废除或大幅缩短版权,用 AI 利润资助 UBI,或者接受“艺术工作”会变成小众/赞助式工作,而创作大多会变成工具中介的活动。