Hister:为你访问过的页面和保存的文件打造的私人搜索引擎
一个名为 Hister 的新开源工具把你的浏览历史、书签、本地文件,甚至社交媒体内容,变成一个私有的、可全文搜索的索引,并保留在你自己的机器上。评论者将它与 Google Desktop、ArchiveBox、Zotero 以及各种自制方案进行比较,称赞它能找回之前访问过的页面,同时也在讨论本地与云端托管、浏览器集成和长期归档之间的取舍。项目作者也参与讨论,提到了计划中的功能、多设备支持、项目被迫改名的法律压力,以及与本地 LLM 和其他自托管服务的潜在集成。
概述与用途
- 该工具为你访问过的页面和保存的文件构建一个私有搜索引擎。
- 重点是个人知识检索,而不是通用网络搜索。
- 作为已访问页面、书签、浏览器历史、本地文件和爬取站点的索引来使用。
功能与架构
- 存储提取出的页面内容以及离线预览,因此即使来源发生变化或消失,结果仍然保留。
- 支持全文搜索和语义搜索,提供 Web UI、CLI 和用于 AI/助手集成的 MCP 端点。
- 浏览器扩展会索引标签页中实际渲染出来的内容,因此可以捕获登录后和“关闭”站点中的内容(Instagram、Discord、Twitter、通过
yt-dlp获取的 YouTube 文稿等)。 - 可在多台机器上使用,也支持多用户部署;没有强制的云端组件。
与其他工具的比较
- 与 ArchiveBox 相比:这里更侧重快速知识检索;ArchiveBox 更侧重长期保存。有些用户只想要一个共享档案库,而不是两个。
- 也有人提到类似或相近的工具:linkwarden/linkding/Betula、Zotero、SingleFile、Google Desktop、旧版 Chrome/Opera 历史搜索、recoll,以及各种自制历史索引器。
- 一些人认为它是现代版的强大本地搜索工具,而浏览器后来把这类功能“阉割”了。
隐私、安全与托管顾虑
- 很多人强烈希望数据保持本地,并避免依赖云端 LLM;也有人接受用 ChatGPT 或本地模型作为“推理层”来前置处理。
- 有人对运行发行版仓库之外的软件持谨慎态度,或担心安全漏洞;建议包括容器、AppArmor、systemd 加固和严格的网络分段。
- 也有人偏好更低技术门槛的替代方案,比如把页面打印成 PDF 再用
pdfgrep。
真实使用反馈
- 多位用户表示已经使用了数周到数月,并称其对查找遗忘的链接、索引笔记/Obsidian,以及让社交/网页内容可搜索来说“不可或缺”。
- 有一条反馈称,通过 Nginx 反向代理时出现严重的资源问题;根因不明。
限制与功能请求
- 期望的功能包括:
- 页面上的笔记/批注、仅书签过滤器、可见时长阈值(例如只索引查看超过 4 秒的标签页)、保留旧版本和差异、邮件索引、Android/Chrome 支持、更多书签管理器集成。
- 也有人质疑构建复杂知识库的个人投入产出比,更偏好极简主义。
命名与商标争议
- 目前名称与一个现有的美国商标冲突;维护者预计会重命名。
- 讨论串中有许多替代名称建议,也在争论是否从法律上必须改名。