我们对开权重模型的立场
Anthropic 关于“开权重” AI 模型的公开立场引发了围绕安全、竞争与地缘政治的激烈争论。该公司主张,对强大模型应实施强制安全测试,应限制专有模型的蒸馏,并应将先进芯片排除在中国之外,以防止威权主义滥用,同时仍允许能力较弱的开放模型。批评者认为这是一家用抓取数据训练出来的公司搞监管俘获与虚伪,质疑谁来定义“危险能力”,并反驳说开放模型对防御是必需的、根本无法被真正遏制,而且美国将 AI 用于监控和战争的做法并不比中国更可信。
感知到的动机与监管俘获
- 许多人认为这篇文章是典型的“监管我的竞争对手”策略:借助安全和中国作为理由,削弱开权重竞争者,同时为美国大型实验室保留护城河。
- 批评者指出其前后矛盾:先说“我们从未主张禁止开权重”,紧接着又呼吁强制安全测试和打击,而这些措施大多会影响开放模型。
- 少数人认为,这种立场与长期以来的安全担忧内部一致,并不比其他行业游说监管更糟。
开权重、“安全测试”与事实上禁令
- 一派观点认为:对“足够强大”的模型进行强制安全测试,本质上就是对有能力的开权重模型实行事实上的禁令,因为任何安全层都可以通过微调移除或绕过。
- 也有人认为安全测试是常识(可类比药品、汽车、飞机),而且会同时适用于闭源和开源模型;真正难的问题在于如何定义“足够强大”和“危险”。
蒸馏与知识产权
- 对“打击工业规模蒸馏”的反弹非常强烈:评论者指出,这些实验室训练时使用了海量未经同意的数据集(包括盗版书籍),如今却想保护自己的输出。
- 有人认为蒸馏在法律上不同于版权侵权;按现行规则,最坏也只是违反服务条款,而不是侵犯知识产权。
中国、威权主义与美国虚伪
- 文章将中国政府视为主要威胁的重点遭到强烈质疑。
- 尤其是非美国评论者认为,美国至少同样危险:战争、监控、军事 AI,以及当前的政治不稳定,都削弱了其道德高地的说法。
- 也有人坚持,从美国国家安全的角度看,阻止竞争对手霸权体获得 AI 优势是合理的。
网络/生物风险与 Hugging Face 事件
- 网络和生物风险是核心安全理由,但许多人认为生物灾难情景只是“电影情节”式的推测。
- 最近一次事件中,一个闭源美国模型被用于攻击一个大型托管平台,而在事后分析中使用了一个开权重中国模型,这一点被反复提及:
- 一种观点:这表明当闭源模型被护栏或访问策略隔离时,开源模型对防御至关重要。
- 另一种观点:开源模型是在损害已经发生之后才介入;攻击者从强大工具中获得的收益仍然远大于普通防御者。
控制措施的可行性与有效性
- 对禁止开权重、微调或“蒸馏”的可执行性存在强烈怀疑:模型只是文件,极易复制和走私;任何监管最终主要只能约束守法公司和用户。
- 对芯片出口管制则被认为更具实际可执行性,但很可能只会:(a) 买来时间,以及 (b) 加速海外本土芯片发展。
开权重:公共利益还是威胁
- 开权重支持者强调:
- 在网络攻防上,攻防具有对称性;防御者也需要强大的工具。
- 历史类比密码学:试图限制强密码最终失败,而且伤害了普通用户多于罪犯。
- 怀疑者担心,一旦真正前沿级模型开放,任何现实可行的对齐或护栏方案都无法阻止其被用于网络或生物攻击。
社区对公司的情绪
- 讨论串中的情绪明显偏负面:指责其虚伪、制造恐慌、以美国为中心的沙文主义,以及“主角思维”。
- 也有较小一群人为安全框架辩护,但往往仍批评其公关和政治语气,尤其是中国言论以及缺乏具体、可行的机制。