Hister:为您的AI助手提供私人记忆

Reddit r/LocalLLaMA 工具

摘要

Hister 是一款个人搜索引擎,可索引您的浏览历史、文档和本地文件,并通过 MCP 将该索引暴露给 AI 助手,使其能够基于您的私人上下文来回答问题。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/01 12:09

# 给你的 AI 助手加上私有记忆 来源:https://hister.org/posts/give-your-ai-assistant-a-private-memory AI 助手很擅长解释事物,但它们通常对你个人的上下文记忆较弱。 它们不知道你上周读过哪个文档页面。不知道是哪篇文章说服你尝试某个库。不知道你遵循了哪个迁移指南,哪个 GitHub issue 里有变通方案,或者你信任过哪篇安全分析文章。 这些上下文通常存在于你的浏览器历史记录、书签、本地笔记以及依稀记得的搜索查询中。 Hister 将这些上下文转变为私有搜索索引。通过 MCP 支持,它还能让 AI 助手访问该索引。 ## Hister 快速简介 Hister 是一个用于你关心的页面和文件的个人搜索引擎。 浏览器扩展会在你浏览时自动索引页面。命令行工具可以导入浏览器历史记录、爬取文档站点、手动索引 URL 以及添加本地文件。网页界面让你可以搜索所有内容,支持全文搜索、字段筛选、标签、分类、优先级结果以及可选的语义搜索。 关键之处在于数据存储的位置。 你的浏览历史、索引页面、搜索查询和本地文件都保留在你的 Hister 实例中。对大多数人而言,这意味着它们留在同一台机器或你控制的服务器上。 这也意味着你不需要为你使用的每个站点分别设置助手技能。你不需要让助手单独访问 GitHub、文档站点、问题跟踪器、论坛、Wiki 以及其他需要身份验证的站点。如果有用的页面已经在 Hister 中,助手可以直接搜索 Hister。 > **相比于将每个私有服务都接入你的助手,Hister 为它提供了一个统一的搜索接口,只查询你已经索引过的资料。** 这使得 Hister 本身就是一个有用的日常搜索工具。MCP 则增加了另一层能力:助手可以询问 Hister 获取相关页面,而不是依赖通用模型知识或随机抓取网络结果。 ## 实用的 Hister MCP 工作流 以下是一些 Hister MCP 在日常工作中的实用方式。常见模式很简单:助手先向 Hister 查询,然后基于你已索引的页面和文件工作。 ### 找到你隐约记得的文章 你遇到过这种情况:你读过一篇对某个 Bug、设计模式或部署问题的很好解释,但想不起标题或站点。 没有 Hister,你向助手提出一个宽泛的问题,得到宽泛的答案。答案可能有用,但并非基于你记得的那个来源。 配置好 Hister MCP 后,你可以问: `` 搜索我的 Hister 索引,找出我读过的那篇关于 PostgreSQL 迁移锁定的文章,并总结最相关的结果。 `` 助手可以搜索 Hister 中的 `PostgreSQL migration locking`,检查存储的结果,并根据你自己索引中的页面来回答。 如果 Hister 服务器启用了语义搜索,助手还可以请求语义匹配。当你记得概念但想不起确切词语时,这很有用。如果服务器上没有语义搜索,Hister 会回退到普通的关键词搜索。 ### 使用你已经索引的文档解释代码 AI 编程助手通常从广泛的训练数据中回答。这很有用,但可能对你自己使用的库或框架的确切版本不准确。 Hister 为助手提供了更具体的上下文来源。 你可以爬取某个项目的文档: `` hister index --recursive --allowed-domain=docs.example.com --max-depth=4 https://docs.example.com/ `` 你也可以直接使用 Hister 准备好的文档数据集,而不必自己爬取所有内容。数据集页面(https://hister.org/datasets)包含常用参考资料的导入,例如语言和平台文档,这样你的助手在导入后就可以立即通过 Hister 搜索这些文档。 然后,在 AI 助手中询问: `` 在我的 Hister 索引中查找官方文档,关于配置此库的连接超时。然后解释哪个选项适用于这段代码。 `` 助手可以搜索你索引的文档,获取预览,并在解释代码时使用这些页面。 这对于内部文档、私有 Wiki、旧版 API 或难以通过常规网络搜索找到的文档尤其有用。 ### 将研究转化为有源头的简报 当你花几天时间研究一个主题时,有用的材料通常分散在标签页和历史记录中。 有了 Hister,浏览即捕获。有了 MCP,助手可以将捕获的材料转化为简报。 示例提示: `` 搜索我 Hister 历史中最近一个月关于供应链攻击的页面。按事件分组结果,列出受影响的项目,并引用你使用的页面。 `` 助手可以使用 Hister 搜索工具中的日期过滤器,然后检索最相关页面的存储预览。结果不仅仅是供应链攻击的通用总结,而是你实际阅读或索引过的材料的总结。 这适用于安全研究、学术文献综述、市场调研、项目规划以及任何需要来源可追溯性的工作流。 ### 从近期历史记录继续 有时你甚至不知道要搜什么。你只知道你之前读过一些相关内容。 `get_history` 工具让助手可以检查最近索引的页面或最近打开的 Hister 结果。 你可以问: `` 查看我最近索引的 Hister 页面,告诉我哪些与我们正在调试的缓存问题相关。 `` 助手可以从近期历史记录入手,识别可能的来源,然后通过搜索和预览检索来深入挖掘。 这与让助手访问整个开放网络不同。它首先查看你在工作时创建的页面轨迹。 ### 从浏览历史记录创建工作日志 工作日志很有用,但手动编写很容易忘记。Hister 已经知道你工作期间索引、搜索和打开了哪些页面,因此助手可以利用这个轨迹起草每日或每周日志。 你可以问: `` 查看我今天在 Hister 中索引的页面。按项目分组,总结我做了什么,并创建一个包含源 URL 的简短工作日志。 `` 当助手将结果视为草稿时,效果最好。你仍然决定最终工作日志中包含什么内容,但从浏览器历史记录重建一天的枯燥工作已经为你完成了。 有关保持工作日志轻量化的更多细节,请参阅 kvch 的文章《Worklogging for the Lazy Dev》(https://kvch.me/worklogging-for-the-lazy-dev/)。 ## 隐私与控制 Hister MCP 不需要将你的整个历史记录发送给 AI 提供商。 助手请求特定搜索。Hister 返回匹配的结果和预览。你可以使用访问令牌或用户令牌保护端点。你还可以通过跳过规则、手动索引、自动索引设置、标签和域名规则来控制哪些内容可以进入索引。 警告:如果你将 Hister MCP 连接到由外部 AI 提供商支持的助手,Hister 返回的搜索结果和预览可能会作为对话上下文的一部分发送给该提供商。这可能会暴露私有浏览数据、索引文档、页面标题、URL、片段以及存储的页面内容。 如果你想避免将材料发送给外部 AI 提供商,请使用本地模型。这可以将助手和 Hister 都保留在你控制的基础设施上。你还可以添加跳过规则,从一开始就让私有或敏感页面不进入 Hister,这样它们以后就无法通过 MCP 返回。 这很重要,因为个人搜索索引是敏感的。它反映了你阅读的内容、你工作的内容、你调查的内容以及你忘记的内容。 Hister 的设计初衷是让你可以决定哪些内容被索引、存储在哪里以及哪些客户端可以读取它。 ## 入门指南 首先,按照《获取 Hister 指南》(https://hister.org/docs/installing)操作,运行 Hister(https://hister.org/docs/quickstart),并确保你有一些内容被索引。浏览器扩展是在正常浏览期间构建索引的最简单方式。你还可以导入现有的浏览器历史记录或爬取文档站点。 然后配置你的 MCP 客户端使用: `` http://127.0.0.1:4433/mcp `` 如果启用了身份验证,请将你的 Hister 访问令牌作为 Bearer 令牌传递。 完整的设置指南在 MCP 集成文档中(https://hister.org/docs/mcp)。 ### MCP 增加了什么 MCP(https://modelcontextprotocol.io/)是一种协议,允许 AI 工具连接到外部数据源和工具。Hister 在 `/mcp` 暴露了一个 MCP 端点。 通过该端点,助手可以: 1. 使用 `search` 工具搜索你索引的页面和文件。 2. 使用 `get_preview` 检索特定页面的存储预览。 3. 使用 `get_history` 检查最近索引或最近打开的 Hister 历史记录。 这将助手从通用的答案机器转变为更接近研究伙伴的角色,可以与你已经阅读过的材料一起工作。 #### 更好的答案,无需重新获取页面 许多助手工作流依赖于再次获取 URL。这可能因为登录墙、速率限制、页面已删除、机器人保护或内容变更而失败。 Hister 已经存储了索引页面的文本和元数据。MCP 的 `get_preview` 工具可以直接检索存储的内容。 这意味着助手可以基于你索引时的页面版本工作,而不是基于站点稍后返回的任何内容。 这在以下情况下很有用: 1. 你阅读后页面发生了变化。 2. 页面不再可用。 3. 页面需要在你的浏览器中有会话。 4. 页面屏蔽自动抓取。 5. 你想让助手基于你的个人档案工作。

相似文章