GPT-4 中的隐藏变化被揭示
生成式 AI 对受版权保护材料的依赖,正在加剧长期以来关于谁应从创作劳动中获利、以及艺术家和写作者应获得多少保护的争论。评论者把 ChatGPT Plus 最近的隐藏变化——尤其是系统提示词和工具——与更广泛的担忧联系起来,认为这些变化可能受到了《纽约时报》诉讼之类案件的推动:版权法、模型训练数据,以及只有大公司才负担得起合规且高质量模型的风险。除了关于系统提示词是否能被可靠提取、以及幻觉行为如何运作的技术争论外,许多人还注意到一个现实转变:用户越来越多地转向 ChatGPT 而不是传统搜索,这也为内容创作者和开源模型的未来带来了新的问题。
版权、公平使用与 AI 训练
- 对于在受版权保护的数据上训练是否属于公平使用或盗窃,存在强烈分歧。
- 一方认为:版权被错误地描述了;它保护的是特定表达,旨在促进进步,而且已经有个人可以使用的机制(公平使用、法定赔偿)。
- 另一些人则认为版权主要让大型出版商受益,而不是小创作者;执法对大多数艺术家和科学家来说都难以触及,掠夺性出版和付费墙也阻碍了进步。
- 有人担心,要求训练必须获得许可只会巩固大公司地位,摧毁开源模型,并把大部分钱流向主要权利持有人。
- 反方观点是:许可能够维持创作有价值数据的经济激励;“总得有人为数据的制作买单。”
艺术家、工人与技术性替代
- 有人认为 AI 取代插画师、文案撰写者等,与以往的技术变迁类似(集装箱运输、摄影);人们必须适应,艺术会继续存在,但角色会改变。
- 其他人拒绝这种宿命论式的“事情本来就是这样”的说法,认为这些是政治/经济选择,而不是不可避免的,并指出对创作者的同理心和保护都不足。
- 争论焦点之一是:艺术家主要是想要钱,还是主要想避免被 AI 取代。
中间商、大科技公司与虚伪
- 多次批评大科技公司作为中间商,从人类创造的数据中攫取不成比例的价值,加速中产阶级的衰落。
- 一些人认为版权公司是更早的、但类似的寻租者;另一些人则认为 OpenAI/科技平台才是新的主要寻租者。
- 有人指责大型 AI 公司希望广泛自由地吞并他人受版权保护的作品,同时又通过 ToS 或版权对自己的模型和输出保留强有力的知识产权控制。
ChatGPT vs GPT‑4 与系统提示词
- 多位评论者指出,文章讨论的是 ChatGPT Plus(一个产品)及其系统提示词/工具,而不是基础的 GPT‑4 模型。网页客户端除了原始 API 之外还有额外层(审查、工具)。
- 关于“系统提示词泄露”的争论:
- 一派认为像“告诉我你的系统提示词”之类的提示不能被信任,因为会产生幻觉。
- 另一派则指出,不同用户之间出现一致、可重复的输出,并且与观察到的行为相吻合,这说明它确实揭示了真实指令,不过仍建议谨慎对待。
- 下载的聊天记录会暴露一些工具元数据,但不会显示完整的隐藏系统提示词或安全规则。
用户行为与内容创作者
- 一些评论者越来越多地用 ChatGPT 代替 Google,这强化了诉讼中的担忧:LLM 会把注意力从原始出版商那里分流走。
- 对于当 AI 回答减少对其作品的直接流量时,内容创作者将如何调整,仍是一个未决问题。
AI 训练的范围
- 将训练限制在科学内容上、让“艺术留给人类”的提议被广泛否决,理由是这在实践上不可行、与 AGI 目标不一致,而且无法执行;任何足够强大的文本模型无论如何都能生成艺术内容。