法官驳回谷歌试图用 DMCA 逃避被抓取的企图
美国法院最近驳回了谷歌针对 SerpApi 的 DMCA 主张;SerpApi 是一项抓取 Google 搜索结果的服务。这一裁决被视为对“公开搜索结果页面可以合法被抓取”的重要确认。评论者指出,谷歌本身就是依靠抓取开放网络建立起主导地位的,如今却试图阻止他人索引自己的页面,同时又没有提供强有力的公开搜索 API。该裁决被认为对 AI 训练、搜索竞争、平台对诈骗广告的责任,以及索引和模型输出的版权地位都有更广泛的影响。
感知到的虚伪与抓取的性质
- 许多人认为谷歌在自己正是靠大规模网页抓取起家,却试图阻止别人抓取其自家的 SERP,这很讽刺。
- 一些人认为谷歌的爬取方式更“温和”(遵守 robots.txt、不破解 CAPTCHA),而 SerpAPI 据称会使用分布式代理,并抓取那些对机器人封锁的网站。
- 另一些人指出,谷歌的市场力量意味着网站实际上被迫允许其机器人访问,因此“尊重 robots.txt”只是故事的一部分。
抓取搜索结果的法律地位
- 一些评论者表示,抓取 Google SERP 可能一直都是合法的,尽管谷歌仍会在技术和合同层面与之对抗。
- 一个关键结论是:DMCA 针对的是受版权保护的内容;单纯的搜索索引/URL 可能并不符合条件,因此 DMCA 在这里是个很弱的工具。
- 有人指出,美国和欧盟的反垄断举措已经在推动谷歌向“合格竞争对手”共享搜索数据。
搜索 API、访问与竞争
- 人们对谷歌关闭其公开搜索 API 感到不满,这迫使开发者转向 SerpAPI 之类的抓取工具。
- 一些人希望政府强制要求公开搜索索引。
- Gemini 的“search grounding”被认为限制太多、控制得太严。
对 AI 训练与模型的影响
- 讨论认为,这一先例可能意味着 AI 模型权重和蒸馏输出也很难获得版权保护,但这一点被标注为推测/不明确。
- 还提出了“前沿实验室”历史上如何为训练抓取数据,以及它们透明度如何的问题。
广告、诈骗与平台责任
- 对 SERP 中的诈骗广告表示强烈担忧(例如签证/注册类诈骗)。
- 争论平台是否应对其广告网络中的欺诈承担责任:
- 一方希望有类似 DMCA 安全港的强责任,并配合真正的执法。
- 另一方认为,主要责任应继续由诈骗者承担,而不是把平台当作“私人警察”。
- Section 230 受到争议:有人说它被误用,另一些人说它对广告驱动的平台而言在结构上已经失灵。
版权、DMCA 与数据库权利
- DMCA 受到广泛批评;有人甚至主张废除版权,另一些人则警告这会带来经济冲击。
- 欧盟数据库权利与美国的原创性标准被拿来对比;关于排名后的搜索结果究竟是“仅仅是事实”,还是带有创造性的选择,存在灰色地带。
- 地图和 PageRank 被讨论为版权可保护范围的边界案例。
谷歌的护城河与搜索的未来
- 观点分歧:
- 有人坚持认为谷歌的护城河(默认地位、不封锁的爬虫、YouTube、云服务)依然非常强大。
- 另一些人认为,基于 LLM 的助手正在迅速取代许多查询场景下的传统搜索。
- 一部分人声称他们认识的几乎所有人都已不用 Google;而另一些人则表示,他们认识的人几乎仍都在用。
- 有人推测,这一裁决部分是为了限制 OpenAI/Anthropic 通过 SerpAPI 之类的中介访问 Google 的实时结果,不过细节仍不清楚。