@huangyun_122: Mac 在做 RAG 知识库时,有个非常好用的工具: Mac VisionOCR, 比起百度 PaddleOCR,速度上完胜 我在 Mac Air 上识别扫描版的PDF,推理速度相比,差之千里
摘要
推荐 Mac 上的 OCR 工具 Mac VisionOCR,声称在处理扫描版 PDF 时速度远超百度 PaddleOCR,适合用于构建 RAG 知识库。
Mac 在做 RAG 知识库时,有个非常好用的工具:
Mac VisionOCR, 比起百度 PaddleOCR,速度上完胜
我在 Mac Air 上识别扫描版的PDF,推理速度相比,差之千里 https://t.co/8mOEyRZ4Cf
查看缓存全文
缓存时间: 2026/07/10 18:15
Mac 在做 RAG 知识库时,有个非常好用的工具: Mac VisionOCR, 比起百度 PaddleOCR,速度上完胜
我在 Mac Air 上识别扫描版的PDF,推理速度相比,差之千里 https://t.co/8mOEyRZ4Cf
相似文章
@knowledgefxg: 实用开源小工具推荐:pdf-inspector 解决的是一个很实际的问题:并不是所有 PDF 都需要 OCR。 比方说你扔给它一个 PDF,它先判断这个 PDF 到底是什么类型——是正常的文字版(比如用 Word 导出的)、还是扫描版(图…
pdf-inspector 是一个开源的 Rust 库,用于智能分类 PDF 类型(文字版或扫描版),并提取文本和转换为 Markdown,避免不必要的 OCR,提高速度和节省成本。
@CoderDaMing: 中国开源了一个花生大小的OCR,能一次性解析整个100页PDF。 叫'Unlimited-OCR'。仅3B参数。本地运行。 其他OCR工具都是逐页切割文档,容易丢失上下文。这个一次性读取整个文档。 → 单次'长视野'解析(32K上下文窗口…
中国开源了仅3B参数的OCR模型Unlimited-OCR,能一次性解析整个100页PDF,支持本地运行,准确率93%,完全免费开源。
@AIExplorerTim: 有人刚刚开发了一个工具,可以将 PDF 转换为 干净、结构化的 Markdown 速度达到 100 页/秒 不需要 GPU。 不需要 API 成本。 没有混乱的解析。 只有原始的、可用的数据。 它可以轻松处理的内容: • 表格 → 完美提…
OpenDataLoader 是一个开源工具,可将 PDF 转换为结构化的 Markdown 和 JSON,支持 100 页/秒的本地处理速度,无需 GPU 或 API 成本,专为 RAG 管道和 PDF 无障碍自动化设计。
@GoSailGlobal: 现在的 OCR 处理几十页文档,是逐页跑的 每翻一页,记忆清零一次 百度今天悄悄在 GitHub 和 HuggingFace 开源了一个模型,叫 Unlimited OCR,它的灵感,来自人类抄书: - 你抄一本书,不会每写一个字就把前面…
百度开源了 Unlimited OCR 模型,采用参考滑动窗口注意力(R-SWA)机制,实现了对长达 32K 上下文的一次性文档解析,无需逐页推理。
@BlockInsight214: 论文、合同、扫描件丢给 AI 之前,最难的一步往往是「先把 PDF 洗干净」。这几个开源项目专干这件事:转成 Markdown/JSON,直接喂给 RAG 或 agent。 ① MarkItDown · 微软出品,Office/PDF/图…
介绍了五个开源工具(MarkItDown、MinerU、Docling、marker、surya),用于将PDF、Office文档等转换为Markdown或JSON,以便直接供RAG或AI代理使用。