Kreuzberg (本地文档提取) 被重命名为 Xberg - 当前版本为长期支持版本
摘要
Kreuzberg,一个本地文档提取工具,被重命名为 Xberg,其当前版本处于长期支持(LTS)阶段。
暂无内容
相似文章
Xberg v1 发布
Xberg v1 作为 Kreuzberg 的继任者发布,是一个高性能内容智能框架,支持 101 种文档格式、367 种代码/数据类型、音视频转录和 URL 抓取,拥有纯 Rust 的 PDF 和 OCR 后端、多种语言绑定以及移动端/WASM 支持。
Xberg:面向智能体的本地“读取任意文档”工具
Xberg 是一个本地内容智能框架(Rust 核心,MIT 许可),通过 MCP 服务器或 CLI 从 101 种文档格式中提取文本,重建阅读顺序和表格,并为上下文窗口分块——所有操作均在设备端完成,服务于 AI 智能体。
@mdancho84: 告别文档提取器。Google 刚刚发布了 LangExtract:开源。免费。比价值10万美元的企业工具更强大。以下是……
Google 发布了 LangExtract,一款开源免费且性能超越昂贵企业工具的文档提取工具。
将一堆文档转化为可搜索、可用的知识库
DocuBrowser 是一个开源工具,它使用 SQLite FTS5 和来自 Ollama 的 AI 嵌入向量对本地文档(PDF、Word、电子书等)进行索引,实现关键字与语义的混合搜索以及 AI 生成的摘要,所有这些都可以离线运行,无需互联网或 API 密钥。
超越单语深度研究:使用跨语言BrowseComp-Plus评估智能体与检索器
介绍XBCP(跨语言BrowseComp-Plus),这是一个用于在跨语言和多语言环境中评估深度研究智能体和检索器的基准。结果表明,当证据与查询语言不同时,性能显著下降,凸显了检索失败以及智能体在整合语言不匹配证据方面的困难。