LokalBot 更新:本地智能体模式、MCP 访问会议、系统级听写和公证构建,依然 100% 本地设备运行且开源
摘要
LokalBot v0.2.0 更新新增本地智能体模式、用于会议查询的 MCP 服务器、系统级听写以及改进的资源管理,仍保持 100% 本地设备运行和开源状态。
两周前我在本地发布了 LokalBot(之前的帖子),这是一款 Mac 应用,用于录制和总结会议、在任何应用中自动补全输入、以及追踪你的一天,所有模型均在设备上运行。那篇帖子中的反馈变成了为期两周的修复和发布冲刺,所以这是更新内容。
首先,v0.2.0 版本已正确签名,因为我购买了 Apple 开发者账户,不再有 Gatekeeper 警告。其次,上次我警告过的 RAM 峰值问题。所有内置推理现在都通过一个代理进行:三个 llama-server 实例(主模型/嵌入/联合输入)采用租约管理,因此没有活跃工作的任何内容在短暂停留后卸载并归还 RAM,加载的模型在驻留预算下运行,并采用 LRU 淘汰策略。设置中有一个实时资源监控器,显示已加载的内容以及哪个租约在固定它。空闲占用不再是“你上次接触的任何内容”——服务器仅在实际上有内容正在使用时才占用内存。
自上次帖子以来的新功能:智能体模式。一个嵌入式编码智能体 (pi) 通过兼容 OpenAI 的 shim 连接到同一个本地主 LLM,即运行在你自己的 GGUF 上的编码智能体,完全离线(--offline,禁用版本检查)。write / edit / bash 调用通过原生命名审核卡进行控制。它所需的 Bun 运行时通过校验和固定,并在首次启用时下载,不捆绑。
用于会议库的 MCP 服务器。lokalbot-cli mcp 通过 stdio 提供 list_meetings / get_meeting / search_meetings / ask_library,因此 Claude Desktop(一键 .mcpb 捆绑包)或任何 MCP 客户端都可以查询你的会议。ask_library 通过应用的本地 llama-server 进行回答,因此即使“从另一个应用与我的会议聊天”也永远不会离开本机。默认关闭,位于明确的隐私切换后面。
系统级听写。按住 ⌥ 空格键,说话,松开后,设备的 ASR 会在光标处粘贴到任何应用中。先暂停音乐,说话时显示实时转录,之后删除音频。重复使用你已选择的任何转录引擎和语言。
实时会议视图。通话期间(可选)显示滚动转录和快速笔记,而不是在通话结束后才全部显示。
设备端 TTS。Kokoro(通过 sherpa-onnx)朗读摘要和聊天回答。
联合输入修复:单词中间补全,光标现在在 Chromium/Electron 应用中正确渲染,更好的句子/标点处理。
乏味但重要:模型下载现在可断点续传 + SHA 验证 + 磁盘/RAM 预检查;录音恢复得到强化,因此会议中崩溃不会损失音频;聊天工具调用受 JSON 模式约束,回答引用源会议;远程说话者从日历邀请中命名,而不是“他们”。
UI 重新组织:侧边栏折叠为 Capture / Ask / Type,入门仅需麦克风,屏幕捕获和日追踪现在为真正的可选功能。
未改变:仅限 Apple Silicon / macOS 15+(它紧连神经引擎、MLX 和 Core Audio 进程监听;没有 Linux/NVIDIA,抱歉)。默认设置仍为转录使用 Granite Speech 4.1 (2B) Q4,总结使用 Qwen 3.6 35B-A3B,联合输入使用 Gemma 4 E4B——上次帖子中没人说服我换掉它们,所以这是你的第二次机会。
关于网络要求的精确说法,因为这个分论坛让我保持诚实:开箱后唯一的流量是一次性模型/运行时下载(Hugging Face 下载 GGUF,GitHub 下载固定的 llama.cpp / sherpa-onnx 二进制文件,以及如果你启用智能体模式则下载 Bun)。之后完全离线,每个服务器仅限本地主机。会议期间使用 Little Snitch 仍然会显示你见过的最平坦的网络图。
GitHub (GPLv3): https://github.com/stevyhacker/lokalbot
网站: https://lokalbot.com
我的主要请求:一个更好的小型联合输入模型,足够快以实现击键延迟的幽灵文本,足够智能以值得按下 Tab 键。另外,如果你将自己的智能体设置指向 MCP 服务器,我很想知道缺少哪些工具。
相似文章
Reddit r/LocalLLaMA
LokalBot是一款完全本地化的macOS应用,在设备上运行AI模型,实现会议转录与总结、在任何应用中自动补全以及日追踪,完全保护隐私,无需依赖云端。
Product Hunt
LokalBot 是一款免费、开源的 Mac 应用程序,它利用 AI 在本地搜索会议记录和屏幕文本,帮助用户快速从保存的数据中查找信息。
Reddit r/LocalLLaMA
Lemonade v10.8 引入了自动内存管理、云端卸载、Omni 改进,以及将本地 AI 模型作为 MCP 工具调用的功能。
X AI KOLs Following
# Sourcebot MCP 服务器 - Sourcebot 来源:[https://docs.sourcebot.dev/docs/features/mcp-server?twclid=24ur7m6qrna8fzx0l5w88rsgef](https://docs.sourcebot.dev/docs/features/mcp-server?twclid=24ur7m6qrna8fzx0l5w88rsgef) Sourcebot MCP 服务器将 AI 工具与你的[Sourcebot 部署](https://docs.sourcebot.dev/docs/deployment/docker-compose) 连接起来。这让 AI Agent 和自动化工具能够在你托管于的所有代码中进行搜索、读取文件、解析引用与定义等操作
X AI KOLs Following
pibot 现已完全本地化,采用 Parakeet 进行语音转文字(STT),Qwen3-tts 进行文字转语音(TTS),并通过 llama.cpp 使用 Qwen 3.6 作为本地多模态大语言模型,推理引擎基于 Rust/mlx-c,实现了零 Python 依赖。