Hister:自分だけの検索エンジン。閲覧履歴やファイルを全文検索
Hister – A private, full content search index that you control

Histerは、ブラウザ拡張機能が訪問したページを自動的に保存し、ファイルとあわせて全文検索できるセルフホスト型の検索エンジンです。AIによる意味検索、高度なクエリ、オフラインでのプレビュー、MCPサーバーによるAIアシスタントとの連携など、プライバシーを保ちながら強力な検索機能を提供します。データはすべて自分のインフラ内に留まり、テレメトリやクラウド同期はありません。
あなたのデータは、決してあなたのインフラの外に出ることはありません。
HNでの議論
40- asciimoo
やあ、作者です!Histerを投稿してくれてありがとう。何でも聞いてください。
私の最初のフリーソフトウェア検索プロジェクトはSearxでした。これはプライバシーを尊重するメタサーチエンジンですが、メタサーチの概念の限界のため、別のアプローチを取ることにしました。
Histerは、訪問したページ、ブックマーク、ブラウザ履歴、ローカルファイル、クロールしたウェブサイトから個人用検索インデックスを構築します。抽出したコンテンツをオフラインの結果プレビュー付きで保存するので、元のページが変更されたり消えたりしても情報は検索可能なままです。全文検索とセマンティック検索に対応し、完全に自分のマシン上で実行でき、ウェブインターフェース、コマンドラインツール、アシスタント統合用のMCPエンドポイントも含まれています。
プロジェクトページ: https://github.com/asciimoo/hister
小さな読み取り専用デモ: https://demo.hister.org/
- quasigod
昨日セットアップを終えたばかりで、ちょっと夢中になっています。以前はKarakeepをよく使っていましたが、保存し忘れて失うのが嫌でした。また、Histerのセマンティック検索は、AI生成の要約やタグよりも優れたソリューションだと思います。ローカルドキュメントのサポートもとてもクールで、私はorg notesディレクトリをインデックスするように設定しています。
- wmchen
数ヶ月前にasciimooのHNでのコメントを見てこれをセットアップしましたが、最初はほとんど使っていませんでした。しかし、少し前に、これが私の趣味の一つ(アワードトラベル)のためのかなり便利なリサーチツールになり得ることに気づきました。その趣味は、さまざまな概念や癖を知っていることが重要です。
アワードトラベルでよく参照するブログの投稿をスクレイピングしてインポートし、それをMCPサーバーとしてOpenCode/Codexに接続し、そのコーパスをそれらのトピックのリサーチに使用しました。だから、「この問題に遭遇したという話を誰かがしたことがありますか?」[1]のような質問ができます。
趣味や仕事で、定期的に参照するコアなウェブサイトや参考資料がある場合、Histerはほぼすべてのツールをすぐに使える状態で提供してくれます。彼らが推奨するデフォルトのデータセットには、例としてPython標準ライブラリ、MDN、RFCコーパスが含まれています。[2]
- ebr4him
デザインの雰囲気は、もしかしてCodexでコーディングされていますか?最近似たようなデザインをよく見かけるので、本当にうんざりしています。
- renegat0x0
私は似たような、しかし異なるものを作成しました。自分のインターネットドメインインデックスを維持しています。
https://github.com/rumca-js/Internet-Places-Database
また、場所を検索できるAndroidアプリもメンテナンスしています。
https://f-droid.org/en/packages/io.github.rumcajs.offlineweb...
Histerは自分のデータで埋める必要があると思いますが、違いますか?