检测和应对 AI 滥用:2026年9月
Anthropic 最新关于 AI 滥用的威胁情报报告引发了激烈争论,焦点既在风险本身,也在公司的应对方式上。评论者指出,Claude 据称被用于协助武器开发、监控系统以及双重用途生物研究,同时质疑 LLM 相较于现有科学知识到底增加了多少真正的危险。许多人担心 Anthropic 的监控和拦截做法可能会压制正当研究,并服务于其商业与游说利益,尤其是在模型访问、数据使用和监管控制方面。
常规武器与监控滥用
- 评论者强调报告中的例子:一个与马里有关联的“人口级”SIM 监控系统,以及也门行为者使用 Claude 来进行制导火箭和导弹。
- 还有几位指出,用手机进行导弹制导在技术上是可行的,并援引了更早期的巡航导弹计算机以及廉价雷达高度计 / 飞控器。
- 也有人认为,这些活动在 LLM 出现之前就已经可行;AI 主要是降低了技能门槛并扩大了获取范围。
生物武器与双重用途研究
- 许多人认为生物武器风险很严重,但强调当前仍然很难:需要设备、默会的实验室技能、安全基础设施以及受控材料。
- 也有人强调,LLM 可以让这类工作的部分环节“去技能化”,把专家知识扩散给更多坏人,尤其是内部人员,而不只是普通人。
- 评论者对 Anthropic 的案例研究提出了大量批评,其中 Claude 被用于:
- 毒液衍生疗法与双重用途毒素骨架。
- 禽流感和基孔肯雅热的功能获得研究,或高风险病原体研究。
- 批评者认为,Claude 主要只是提供文书或撰写资助申请方面的帮助,而阻止这类用途会伤害正当的医学研究,包括针对被忽视疾病的研究。
Anthropic 的监控与隐私担忧
- 报告详尽、叙事化的风格让一些人感到不安:这暗示对用户提示词进行了密集的记录和分析。
- 人们担心因为“错误”的问题(例如暴力、生殖健康、移民)而被举报给执法部门,并建议出于隐私考虑使用本地模型或外国托管模型。
- 也有人指出,Anthropic 一直公开表示会出于安全目的进行监控,但这些例子的细粒度和公开发布仍让人感觉侵入性很强。
关于中国实验室和“非法蒸馏”的说法
- 报告指控中国提供商(Kimi、DeepSeek、MiniMax)静默通过代理调用 Claude 来蒸馏其行为,这一点遭到了强烈怀疑。
- 有人认为这符合模型蒸馏行为的可能性;也有人质疑其激励机制(为什么要为更昂贵的模型付费?)以及 Anthropic 的证据。
- 批评者认为,“非法蒸馏”主要是服务条款 / 商业模式问题,而不是公共安全问题。
动机、炒作与监管俘获
- 许多人把这份报告看作营销:展示 Claude 的“能力”,并为更严格的监管提供理由,而这将偏向少数美国实验室,压制开源和外国竞争者。
- 也有人认为这是对双重用途风险的真实早期预警,并主张非国家行为体正是 AI 最可能造成动荡的地方。