Hister:把搜索权收回自己的私有引擎

Hister – A private, full content search index that you control

Hister:把搜索权收回自己的私有引擎

厌倦了数据被巨头垄断?Hister 让你彻底掌控自己的数字足迹。这款开源工具支持自托管,能自动捕获并索引你访问过的每一个网页和本地文件。它不只是简单的关键词匹配,更通过 AI 实现语义搜索,精准理解你的意图。从浏览器扩展的静默抓取,到支持 JavaScript 页面的深度爬虫,再到将个人索引通过 MCP 协议暴露给 AI 助手,Hister 构建了一个完全私密的本地知识库。无需联网即可查看页面预览,支持多语言自动路由,甚至提供终端界面供极客操作。没有遥测、没有云端同步,你的数据永远只留在自己的基础设施上,真正实现了隐私优先的搜索体验。

在享受强大搜索功能的同时,将你的数据保持私密并存储在本地。
  1. asciimoo

    Ohi, 作者在此!感谢发布 Hister。欢迎提问(A.M.A.)。

    我的第一个自由软件搜索项目是 Searx,一个注重隐私的元搜索引擎,但由于元搜索概念本身的局限性,我决定尝试不同的路径。

    Hister 会根据你访问的页面、书签、浏览器历史记录、本地文件以及爬取的网站构建个人搜索索引。它存储提取的内容并提供离线结果预览,因此即使原始页面发生变化或消失,信息依然可被搜索。它支持全文检索和语义搜索,可完全在本地机器上运行,并包含 Web 界面、命令行工具以及用于助手集成的 MCP 端点。

    项目页面:https://github.com/asciimoo/hister

    小型只读演示:https://demo.hister.org/

  2. lnenad

    我太爱这个概念了。我会去试试实际运行效果,如果它真如描述那样工作,那将是一款很棒的产品。

  3. wmchen

    几个月前,我根据 asciimoo 在 HN 上的评论搭建了这个系统,起初几乎没怎么用,但不久前我意识到,对于我的一项爱好(积分兑换旅行)来说,它可能是一个非常实用的研究工具。这项爱好需要我对各种概念和细节了如指掌。

    我抓取并导入了我常参考的积分旅行博客帖子,然后将其作为 MCP 服务器连接到 OpenCode/Codex,利用该语料库进行相关主题的研究。所以我可以问类似“以前有人提到过遇到这个问题吗?”这样的问题 [1]。

    如果你有一项爱好或工作场景,需要频繁参考一组核心网站或参考资料,Hister 几乎开箱即用地提供了所有工具,让你能针对这些内容启动一个搜索引擎。他们推广的默认数据集包括 Python 标准库、MDN 和 RFC 语料库等,作为示例。[2]

    [1]: https://wmchen.com/blog/revisiting-hister/

    [2]: https://hister.org/datasets

  4. renegat0x0

    我也做过类似但不同的东西。我维护着自己的互联网域名索引。

    https://github.com/rumca-js/Internet-Places-Database

    此外,我还维护了一个 Android 应用,可用于搜索地点。

    https://f-droid.org/en/packages/io.github.rumcajs.offlineweb...

    据我理解,Hister 需要你自己填充数据,对吧?

  5. alexnewman

    是时候无耻地推广一下我自己那个易于部署的私有内容搜索索引了:

    Webtm.io

    全部开源,且足够小巧,便于部署。我将其部署在 cf webworkers 上,所以目前也只在那里测试过。

    一个很酷的地方是,它在 iOS、Chrome 及其同类浏览器、Firefox 以及几乎所有地方都能运行。不过,你需要自备 LLM。

同日更多故事

2026-08-22