@DanKornas:Dicklesworthstone/llm_aided_ocr 使用LLM驱动的文本校正对扫描PDF进行OCR GitHub:存档:
摘要
llm_aided_ocr 是一个 GitHub 项目,它对扫描的 PDF 执行 OCR,并使用 LLM 来纠正和改进提取的文本。
Dicklesworthstone/llm_aided_ocr
使用LLM驱动的文本校正对扫描PDF进行OCR GitHub:存档:https://t.co/reWMn8p3np
查看缓存全文
缓存时间: 2026/08/03 19:49
Dicklesworthstone/llm_aided_ocr
用于扫描PDF的OCR,支持LLM文本校正 GitHub: 存档: https://t.co/reWMn8p3np
相似文章
@hasantoxr: 我找到了为LLM时代打造的OCR工具。它叫olmOCR。olmOCR可以处理PDF、扫描件、PNG和JPEG,并将其转…
olmOCR 是来自Ai2的开源OCR工具,能够将PDF、扫描件和图像转换为干净的Markdown格式,旨在通过保留阅读顺序和处理复杂布局,为LLM流水线准备文档。
@DanKornas: thedaviddias/llms-txt-hub 是使用 llms.txt 构建 AI 就绪文档的项目目录 GitHub:归档:
推文重点介绍了 thedaviddias/llms-txt-hub,这是一个使用 llms.txt 提供 AI 就绪文档的 GitHub 项目目录。
PaddlePaddle/PaddleOCR
PaddleOCR是一个功能强大、轻量级的OCR工具包,可将PDF和图像转换为结构化数据,适用于AI应用,支持100多种语言,旨在连接文档与大语言模型。
@jerryjliu0: 对纯文本PDF进行OCR不需要重型VLM。这就像用火箭筒去参加刀战,……
LlamaIndex 宣布在 LlamaParse 中改进了路由机制,该机制为简单的文本密集型 PDF 选择轻量级解析,而为包含表格或图表的复杂页面选择更重的基于 VLM 的解析,从而优化成本和准确性。
ICDAR 2026 HIPE-OCRepair竞赛:基于LLM的历史文档OCR后校正
本文介绍了ICDAR 2026的HIPE-OCRepair-2026竞赛,评估了使用LLM对英语、法语和德语历史文档进行OCR后校正的效果。结果表明,现代LLM系统能显著提升OCR质量,但在低噪声输入上的过校正仍是一个挑战。