反 AI 字体无用且有害

试图通过“反 AI”字体来迷惑网页抓取器的做法,正因其有效性和副作用而受到质疑。评论者认为,任何人类能读的字体,很快就会被 OCR 或适配后的模型轻松处理,使这些方案只会成为短暂障碍,却大多会破坏辅助功能、搜索以及真实用户的基本可用性。许多人认为,抵制不受欢迎的 AI 训练,真正更有力的手段在于法律、政策和许可机制,而不是会让开放网络碎片化或退化的技术性混淆。

反 AI 字体的有效性

  • 许多人认为这类字体只是安全表演:任何人类能读的内容,AI 迟早也能读懂,尤其借助 OCR 或字体反向解析。
  • 与 CAPTCHA 相比:基于文本的 CAPTCHA 过去对机器很难,但现在对模型来说已很简单;人们预计字体也会走上同样的道路。
  • 有人认为字体或许能小幅提高抓取成本(例如迫使使用 OCR、浏览器自动化),但反对者说抓取器会很快适应,尤其当这类字体变得普遍时。
  • 批评指出,这类方案只有在稀少时才有效;一旦广泛使用,就会被定制解码器或高效内核破解。

可访问性与对人类的影响

  • 人们强烈担心,混淆字体会不成比例地伤害使用屏幕阅读器、阅读模式、自定义字体或纯文本浏览器的人。
  • 类比为让残障用户走“装卸区”入口:需要额外步骤的可访问性被认为实际上就是排除。
  • 反方观点:有人把可访问性论点轻描淡写为只影响极少数人,或者认为这是阻止 AI 的可接受代价;这一立场也遭到他人强烈谴责。

Shieldfont 及类似方案

  • 讨论了 Shieldfont 这种更复杂的方法:屏幕阅读器可以通过昂贵的“uncover”步骤揭示真实文本;默认情况下,机器人只会得到诱饵文本。
  • 批评者说,这仍然会在解码前阻止辅助技术以及正常的复制/粘贴/搜索,而且任何“解码”机制都可以被抓取器模仿。
  • 还有人担心搜索引擎会索引诱饵内容,实际上把受保护网站送进 SEO“黑洞”;不过也有人指出,社交流量/自然流量可能让这一点尚可接受。

伦理、同意与所有权

  • 有些人认为阻止 AI 是反社会的:AI 从公开文本中“学习”被视为类似索引,最终对人类有益。
  • 另一些人则认为,模型代表着大规模、未经同意的知识产权剥削和权力转移;任何摩擦都是合理的,即便要付出严重的可用性代价。
  • 争论的焦点还包括:托管/抓取成本与不对称性(用户因抓取受罚,而大型 AI 不受罚)是否在道德上足以证明技术抵抗的正当性。

政策 vs. 技术军备竞赛

  • 多条评论指出,技术性的反 AI 措施最终会沦为人类输掉、AI 持续进步的猫鼠游戏。
  • 一些人更倾向于法律、监管或合同方案,而不是脆弱的技术把戏;也有人主张“两者都要”,尽管军备竞赛有其负面后果。
  • 一条反复出现的悲观主题是:如果所有公开信息终究都会被抓取,那么无论是否有基于字体的防御,开放网络都可能退化甚至消失。