比较 Google、Bing、Marginalia、Kagi、Mwmbl 和 ChatGPT

像 “YouTube downloader” 或 “ad blocker” 这类日常查询的搜索结果,正越来越被 SEO 垃圾内容、广告,甚至恶意软件所主导,这促使人们把 Google、Bing、小型搜索引擎(Kagi、Marginalia、Mwmbl)以及像 ChatGPT 这样的基于 LLM 的工具放在一起比较。评论者争论,这种退化在多大程度上源于广告驱动的商业模式,又有多少是因为低质量内容本身数量激增,以及白名单、uBlacklist 或付费搜索引擎这类用户侧修复方案是否真能帮助非专业用户。大家普遍同意,借助正确技巧,技术和小众查询的搜索质量仍然可以很好,但“只要输入你想要的东西,就能得到安全、可信的答案”这件事,感觉比十年前更遥远了。

关于搜索质量的总体看法

  • 许多人觉得 Google 和 Bing 已经退化:广告更多、SEO 垃圾内容、本地垃圾信息,甚至还有恶意软件;如今直接查询感觉像踩进“雷区”。
  • 也有人反馈结果依然不错,尤其是在使用广告拦截器以及进行技术/编程查询时;还有人说现在的结果比十年前更好。
  • 对问题根源存在分歧:
    • 是 Web 本身充斥着低质量、低投入内容,还是
    • 搜索引擎为了广告和参与度优化,而不是为了质量(移除了高级功能,容忍充满垃圾广告的站点)。

“好”结果的主观性

  • 对文章的评估标准争论很大,尤其是“youtube downloader”:
    • 有人同意像 yt-dl/yt-dlp 这样的 CLI 工具才是“正确”的、安全的答案。
    • 但很多人认为普通用户想要的是简单网页或应用,而不是命令行工具,所以把在线下载器排在前面是合理的。
  • 对“ad blocker”也有类似争议:有人坚持 uBlock Origin 必须排第一;也有人认为 AdBlock/ABP“足够好”。
  • 还有几个人认为,用少数几个精心挑选、偏向技术宅的查询来评判搜索引擎并不具有代表性。

Kagi、Marginalia 和其他替代方案

  • Kagi:
    • 支持者称赞它无广告的界面、按域名提升/黑名单、bangs、“Small Web”和 FastGPT 模式;有人说它“感觉像是 enshittification 之前的 Google”。
    • 也有人觉得结果并没有比 Google/Bing 好多少,或者在图片/视频方面较弱。还有人无法复现文章里 Kagi 的糟糕输出(这暗示了地区、时间或自定义设置差异)。
  • Marginalia:
    • 作为一款专注于非商业、“小型 Web”站点并带有强过滤能力的单人搜索引擎,它受到高度赞赏。
    • 也有人批评它不适合常见的导航型查询(例如 Wikipedia/IMDB),而这部分也是其设计目标之一。
  • 其他提到的工具:Brave Search、Searx、Qwant、Metaphor(基于嵌入)、用于用户级黑名单的 uBlacklist、Google Programmable Search,以及目录式方法。

ChatGPT 和基于 LLM 的搜索

  • 围绕使用 GPT-3.5 存在争议:
    • 有人说任何不使用 GPT-4 的评测都在误导人们对“ChatGPT”的理解。
    • 也有人反驳说 3.5 是免费且被广泛使用的版本,因此如果明确标注,测试它是合理的。
  • 有报告称 GPT-4 往往能给出非常好的答案和相关链接,但:
    • 会产生幻觉,每次运行结果不同,并且在“灰色”任务上可能拒绝或闪烁其词(例如 YouTube 下载)。
  • Perplexity、Bing/Copilot 和 Kagi 的 FastGPT 被认为是很有前景的混合方案(在网页结果之上进行 RAG 风格摘要)。

安全、垃圾内容与审查担忧

  • 人们担心搜索引擎会把用户引向恶意软件、欺骗性的下载器,以及内容农场式的“blogspam”。
  • 有些人怀疑某些政治/战争相关内容被低排名;也有人认为那些奇怪的缺失只是普遍的排序问题,而不是刻意审查。
  • 大家普遍同意,激励机制(广告收入、SEO 作弊)在结构上把搜索推离以用户为中心的质量。