Hister 上手:把浏览过的网页和本地文件变成私人搜索库
Hister 是什么,能解决什么问题?
Hister 是一款可自行部署的个人搜索引擎。它会把你访问过的网页、浏览器历史记录、书签,以及指定的本地文件或目录建立全文索引,之后可以通过网页界面、终端或 AI 助手重新搜索这些内容。
它解决的不是“如何搜索整个互联网”,而是“我以前看过一篇资料,现在只记得其中一句话,却找不到原页面”的问题。传统浏览器历史记录通常只能按标题、网址或访问时间查找,Hister则会索引网页和文件的实际内容,因此可以直接搜索正文中的词句。
Hister 的索引和文档默认保存在你配置的服务器上,不依赖必须使用的云端搜索服务。这里的“私人”主要指搜索范围和数据位置由使用者控制:你可以在自己的电脑上运行,也可以部署到自己管理的服务器上。
Hister支持 Linux、macOS 和 Windows 的发布版本。项目采用 AGPLv3 或更高版本许可证;如果从源码构建,则需要 Go 1.26、npm,以及用于 CGO 依赖的 C 编译器。对于普通用户,直接下载对应平台的二进制文件通常是更直接的安装方式。
最快上手:启动 Hister 并接入浏览器
Hister 的基本工作方式是“服务端保存索引,浏览器扩展提交新页面”。因此,使用前需要先启动 Hister 服务,再安装浏览器扩展。服务运行期间,扩展才能把页面交给 Hister,网页界面和其他客户端也才能执行搜索。
1. 下载并准备可执行文件
从项目的最新发布版本中下载与你的操作系统和处理器平台匹配的二进制文件,然后将文件重命名为 hister。Windows 下使用 hister.exe。
在 Linux 或 macOS 上,还需要为文件添加执行权限:
chmod +x hister
2. 启动本地服务
在 Linux 或 macOS 的终端中运行:
./hister listen
Windows 用户可以在 PowerShell 中运行:
.\hister.exe listen
启动命令会运行 Hister 的服务端。使用过程中不要关闭这个终端窗口,因为服务必须持续运行,Hister 才能继续索引页面并响应搜索。
3. 安装浏览器扩展并验证第一条索引
服务启动后,在浏览器打开:
http://127.0.0.1:4433
随后按照页面提示安装 Firefox 或 Chrome 扩展。启用扩展后访问一个网页,再回到 Hister,搜索该网页正文中的一小段文字。如果服务、扩展和索引流程正常,这个页面就应当出现在搜索结果中。
个人本地使用不需要额外配置。这个最小流程只验证“从浏览器采集页面并进行全文搜索”;如果要搜索安装扩展之前的资料,还需要继续导入浏览器数据或添加本地文件。
如何把已有网页和文件加入搜索范围
浏览器扩展主要适合从现在开始自动保存新访问的页面。对于过去已经访问过的内容,Hister提供了几种补充方式:
- 导入浏览器历史记录,让过去访问过的页面进入索引;
- 导入浏览器书签,便于搜索已经收藏的资料;
- 为本地目录建立索引,搜索电脑中保存的文档和其他文件;
- 直接导入文件;
- 使用爬虫索引网站,把指定网站的内容纳入个人搜索库。
这些方式对应不同的资料来源:扩展负责持续收集新页面,历史记录和书签负责补齐既有浏览数据,本地目录与文件索引则把网页之外的个人资料纳入同一套搜索系统。资料只有在被扩展提交、导入或索引之后,才会出现在搜索结果中。
搜索不只是输入关键词
Hister支持全文检索,搜索对象是网页和文件的实际内容,而不仅是标题与网址。最简单的用法是搜索你记得的一个短语;如果结果过多,还可以使用更精确的查询能力:
- 短语搜索:按连续出现的词组查找,适合记得原文表述的场景;
- 通配符:在不确定完整词形或关键词的情况下扩大匹配范围;
- 否定条件:排除包含特定内容的结果;
- 字段筛选:针对特定字段缩小搜索范围;
- 别名:为常用查询或字段设置更方便的写法;
- 结果优先级:调整不同结果在搜索列表中的排序权重。
这些功能适合在资料量增加后使用。刚开始可以先用页面中记得的短语进行全文搜索,确认索引流程可用,再根据结果数量逐步加入字段、否定条件或其他筛选语法。
语义搜索与普通全文搜索有什么不同?
除了基于关键词的全文搜索,Hister还支持可选的语义搜索。语义搜索依靠嵌入服务把文本转换为可比较的表示,再根据内容含义寻找相近文档;因此,即使查询词没有原样出现在文档中,也可能找到主题相关的内容。
这项功能不是默认本地全文搜索的必需条件,需要配置一个由你选择的嵌入服务端点。启用后,文档文本会发送到该端点,用于生成嵌入数据。也就是说,使用语义搜索时,数据流向与“只在本地服务器上做全文搜索”不同,应先查看 Hister 的隐私说明和相关配置,并确认所选嵌入服务的隐私政策。
可以从哪些客户端搜索?
Hister提供网页、终端和 MCP 客户端等访问方式。TUI(终端用户界面)和命令行适合在终端工作流中检索;网页界面则更适合日常浏览和查看结果。
MCP 是一种让 AI 助手调用外部工具的连接协议。将 Hister 接入支持 MCP 的 AI 助手后,助手可以调用 Hister 的搜索能力,在你授权的资料范围内查找网页或文件。它并不会自动让 AI 获得所有文件内容,实际可访问范围仍取决于 Hister 的部署、用户权限和索引内容。
隐私边界:本地运行不等于所有数据永不离开电脑
Hister默认没有遥测,也不要求使用云同步或强制云服务。浏览器扩展会把被索引的网页内容发送到你配置的 Hister 服务器;除索引内容外,扩展还会下载网页的 favicon,也就是网站图标。文档和搜索索引则保存在该服务器上。
如果 Hister 运行在当前电脑上,数据通常会保存在这台电脑;如果把服务部署到远程主机,网页内容、文件内容和索引就会由那台主机保存。因此,判断它是否符合自己的隐私要求时,不能只看“本地搜索”这个名称,还要确认服务实际部署在哪里、哪些客户端会连接它,以及服务器由谁管理。
多人可以共用一台受控服务器,Hister会分别保存每个用户的文档和搜索结果。不过,共享部署仍需要考虑服务器访问控制、账户管理和存储安全。项目材料说明了用户数据的隔离方式,但没有因此替代服务器本身的权限配置。
其他安装方式与适用场景
除了直接下载二进制文件,Hister还提供 Homebrew、Docker 和 Nix 安装方式:
brew install hister
Docker 和 Nix 的具体参数应以项目安装文档为准。需要注意,Go 1.26、npm 和 C 编译器是从源码构建 Hister 时的开发要求,并不是项目材料所列出的普通二进制运行前提。
Hister适合经常需要找回读过的网页、技术文档、书签或本地资料,同时希望自己控制搜索索引位置的用户。它尤其适合个人知识整理、研究资料归档和本地文档检索。
但它不是面向整个互联网的通用搜索引擎,也不会凭空获得你所有过去看过的内容。要让某份资料可搜索,必须通过浏览器扩展、历史记录或书签导入、本地目录索引、文件导入或网站爬虫等方式将其加入索引。理解这一点后,Hister的定位就很清楚:它不是替代公共搜索引擎,而是把已经接触过、希望保留下来的网页和文件变成一套由自己管理的搜索库。