pdf-parsing

标签

Cards List
#pdf-parsing

我用不同类型,比较了更多解析器在14项PDF解析能力上的表现

Reddit r/LocalLLaMA · 4天前

一项基准测试比较了8款PDF解析器在14项能力上的表现,发现Chandra最准确,同时也指出了速度等方面的权衡;LightOnOCR-1B以小体积令人印象深刻,但在无法辨认的文本上会产生幻觉。

0 人收藏 0 人点赞
#pdf-parsing

@llama_index:你不需要视觉模型就能知道 PDF 中有复选框。LiteParse 现在可以直接从……提取结构化数据

X AI KOLs Following · 2026-08-03 缓存

LiteParse 现在支持从 PDF 中提取结构化数据——表单字段、复选框状态、注释、图像、矢量图形和词级边界框——无需视觉模型,并提供复杂度信号,将更困难的页面路由到 LlamaParse 等工具。

0 人收藏 0 人点赞
#pdf-parsing

我用6种文档类型对比了MinerU、Granite-Docling和PaddleOCR-VL的12项PDF解析能力

Reddit r/LocalLLaMA · 2026-08-03

一位开发者对三种PDF解析模型(MinerU、Granite-Docling、PaddleOCR-VL)在六种文档类型和十二项能力上进行了基准测试,发现MinerU会丢失页脚,除非重建其markdown,而Granite-Docling输出更干净的原生markdown表格。

0 人收藏 0 人点赞
#pdf-parsing

为什么所有金额值都是负数?

Hacker News Top · 2026-08-02 缓存

作者解释了为什么客户的PDF银行对账单上所有金额都显示为负数:PDF在与背景相同的灰度级别中编码了不可见的尾随负号,提取代码将其当作可见文本读取。他们讨论了OCR或剥离非黑色文本等解决方案。

0 人收藏 0 人点赞
#pdf-parsing

@VikParuchuri: Marker 最初只是一个小项目,用来解析我的 PDF。如今,Datalab 项目已获得 72k GitHub 星标,每月下载量达 6M……

X AI KOLs Following · 2026-07-25 缓存

Vik Paruchuri 宣布,他的 PDF 解析工具 Marker 已发展为 Datalab 项目,拥有 72k GitHub 星标和每月 6M 次下载,并且他们正在招聘一位创始级开源工程师。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: 我们刚刚发布了LiteParse的一个功能,该功能允许在Rust中原生处理图像到PDF的转换,从而去除对外部包的依赖……

X AI KOLs Following · 2026-07-25 缓存

LiteParse是一个快速、轻量级、开源的PDF解析工具,使用Rust编写,原生支持图像到PDF的转换,并提供带有边界框的空间文本解析,可通过多种包(Rust、Node.js、Python、WASM)使用。

0 人收藏 0 人点赞
#pdf-parsing

@llama_index: 大多数自主检索演示假设文档干净、结构良好。企业现实往往不同,包含…

X AI KOLs Following · 2026-07-06 缓存

LlamaIndex 和 LanceDB 合作构建了一个管道,使用 LiteParse 进行 PDF 解析,并使用 LanceDB 进行多模态存储,从而能够从复杂的企业 PDF 中实现更好的检索,以支持自主工作流。

0 人收藏 0 人点赞
#pdf-parsing

@BlockInsight214: 论文、合同、扫描件丢给 AI 之前,最难的一步往往是「先把 PDF 洗干净」。这几个开源项目专干这件事:转成 Markdown/JSON,直接喂给 RAG 或 agent。 ① MarkItDown · 微软出品,Office/PDF/图…

X AI KOLs Timeline · 2026-06-22 缓存

介绍了五个开源工具(MarkItDown、MinerU、Docling、marker、surya),用于将PDF、Office文档等转换为Markdown或JSON,以便直接供RAG或AI代理使用。

0 人收藏 0 人点赞
#pdf-parsing

@itsafiz:使用 LiteParse 构建了一个超快的 PDF 解析服务!LiteParse 是由 @llama_index 开发的独立开源 PDF 解析工具 f…

X AI KOLs Following · 2026-06-21 缓存

使用 LlamaIndex 的开源工具 LiteParse 和 Cursor AI 的帮助,构建了一个快速的 PDF 解析服务。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: 这太疯狂了,LiteParse 在 Markdown 文档解析上的表现甚至能与前沿 VLM 一较高下——当它…

X AI KOLs Following · 2026-06-19 缓存

LiteParse 是一个快速、开源的文档解析器,在不使用 AI 模型的情况下,其在 Markdown 解析方面的表现优于一些前沿 VLM。它支持多种语言和平台,由 LlamaIndex 开发。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: 我们让Claude在理解PDF方面变得更好更快。秘诀不仅仅是打造最快的免费文档解析器…

X AI KOLs Following · 2026-06-17 缓存

LlamaIndex改进了其用于Claude代理的LiteParse PDF解析技能,通过评估轨迹优化代理行为,使其成本降低37%,准确性更高。

0 人收藏 0 人点赞
#pdf-parsing

@llama_index: 好的文档能为AI代理节省多少成本和时间?结果发现,节省很多。我们构建了一个自定义技能,教…

X AI KOLs Following · 2026-06-16 缓存

LlamaIndex的博客文章描述了为Claude代理构建自定义LiteParse技能,通过分析代理轨迹来修复PDF解析中的低效问题,从而将每个问题的成本降低了37%,并提高了答案质量。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: LiteParse,我们的开源/基于Rust的文档解析器,运行速度之快,连Claude Fable 5都难以置信 🔥

X AI KOLs Following · 2026-06-09 缓存

LiteParse 是一款快速的开源文档解析器,采用 Rust 编写,提供带边界框的高质量空间文本提取功能,支持多种语言和平台,适用于 AI 文档工作负载。

0 人收藏 0 人点赞
#pdf-parsing

@llama_index: 大多数AI管道的质量取决于我们提供的数据,而这些数据通常意味着PDF或其他非结构化文档…

X AI KOLs Timeline · 2026-06-04 缓存

Parse-Flow 是 LlamaIndex 构建的一个开源可视化工作流设计器,它将四个文档处理原语——Parse(解析)、Classify(分类)、Split(分割)和 Extract(提取)——串联到一个由 LlamaAgents 工作流驱动的拖拽画布中,能够从非结构化企业文档(如PDF、合同和发票)中可靠地提取结构化数据。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: 我们解析PDF。我们花了七位数在旧金山各地投放广告牌。我深思熟虑过是否要放些更具创意和趣味的内容。但那样你就不知道我们是做什么的了。

X AI KOLs Following · 2026-06-02 缓存

LlamaIndex 的 Jerry Liu 宣布在旧金山投入超过100万美元的广告牌宣传活动,推广其用于AI代理的PDF解析服务,并列出即将在技术会议上参展的展位。

0 人收藏 0 人点赞
#pdf-parsing

@llama_index: 只需几行代码即可自动化贷款承销流程 一份典型的贷款文件是一叠工资单和…

X AI KOLs Following · 2026-05-26 缓存

LlamaIndex 展示了如何使用 LlamaParse 从金融 PDF 中提取结构化数据,实现贷款承销流程的自动化,包括跨文档分析和人工审核。

0 人收藏 0 人点赞
#pdf-parsing

@rwayne: 太屌了学术论文搭本地知识库,瓶颈一直在 PDF 怎么干净转 md。OpenDataLoader-PDF 把这道题做到了 0.907 准确率 开源 PDF 解析榜第一全套 Apache 2.0。 200 篇真实论文测试集的关键数字 总分 0…

X AI KOLs Timeline · 2026-05-10

OpenDataLoader-PDF 是一款开源 PDF 解析工具,在真实学术论文测试中达到 0.907 的高准确率,支持将复杂的 PDF 文档(含表格、公式、扫描件)高效转换为 Markdown 和 JSON,非常适合本地知识库和 RAG 应用。

0 人收藏 0 人点赞
#pdf-parsing

@AIExplorerTim: 有人刚刚开发了一个工具,可以将 PDF 转换为 干净、结构化的 Markdown 速度达到 100 页/秒 不需要 GPU。 不需要 API 成本。 没有混乱的解析。 只有原始的、可用的数据。 它可以轻松处理的内容: • 表格 → 完美提…

X AI KOLs Timeline · 2026-05-09 缓存

OpenDataLoader 是一个开源工具,可将 PDF 转换为结构化的 Markdown 和 JSON,支持 100 页/秒的本地处理速度,无需 GPU 或 API 成本,专为 RAG 管道和 PDF 无障碍自动化设计。

0 人收藏 0 人点赞
#pdf-parsing

@jerryjliu0: 使用VLM解析PDF的一个缺点是难以保证输出文本的*正确性*和正确的阅读顺序……

X AI KOLs Following · 2026-04-18 缓存

Jerry Liu讨论了使用视觉语言模型进行PDF解析所面临的挑战,特别是关于确保文本正确性和保持正确阅读顺序的同时避免出现幻觉问题。

0 人收藏 0 人点赞
#pdf-parsing

PaddlePaddle/PaddleOCR

GitHub Trending (daily) · 2026-06-05

PaddleOCR是一个功能强大、轻量级的OCR工具包,可将PDF和图像转换为结构化数据,适用于AI应用,支持100多种语言,旨在连接文档与大语言模型。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈