document-parsing

标签

Cards List
#document-parsing

@x5cnhp: 花几百页啃PDF直到手腕酸痛?这类工作其实完全可以交由工具处理…

X AI KOLs Timeline ↗ · 23小时前 缓存

Datalab's Marker v2 是一款开源文档解析工具,能够处理PDF、图像、DOCX和PPTX,输出干净的Markdown,并支持超过90种语言,适用于批量整理、知识库构建和AI文档处理。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: 我们全面评估了16个最新的前沿VLM——包括Opus 5.5和GPT-6 Sol/Luna——来查看更高的努力是否……

X AI KOLs Timeline ↗ · 2天前 缓存

对16个前沿视觉语言模型在文档解析方面的综合评估显示,Opus 5.5在性价比上表现最佳,尤其在表格解析方面,而GPT-6 Luna在成本效益解析方面表现良好。对于大规模使用,推荐使用LlamaParse等专用工具,但Opus 5.5在应用内解析方面领先。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: 我们评估了100多个模型在文档解析上的表现,涵盖前沿VLMs、开源权重VLMs、OCR工具和OSS解析器,请查看p…

X AI KOLs Timeline ↗ · 2026-09-19 缓存

对超过100个模型在文档解析方面的评估,涵盖前沿VLMs、开源权重VLMs、OCR工具和开源解析器,结果通过parsebench分享。

0 人收藏 0 人点赞
#document-parsing

腾讯WeVisDoc

Reddit r/LocalLLaMA ↗ · 2026-09-17

WeVisDoc是一款基于Qwen3-VL模型微调的端到端文档解析器,可将页面图像转换为包含LaTeX公式和HTML表格的结构化Markdown,在OmniDocBench v1.6等基准测试中实现了顶级性能。

0 人收藏 0 人点赞
#document-parsing

WeVisDoc:从覆盖到能力,实现稳健的端到端文档解析

Hugging Face Daily Papers ↗ · 2026-09-17 缓存

WeVisDoc 是一个两阶段的以数据为中心的框架,用于稳健的端到端文档解析,通过扩展覆盖范围并使用针对性诊断来提升性能,在基准测试中取得了最先进的结果。

0 人收藏 0 人点赞
#document-parsing

@svpino:构建一个能处理真实文档的代理仍然极其困难。你们都在谈论通用人工智能(AGI),而这才是实际的问题所在。

X AI KOLs Timeline ↗ · 2026-09-14 缓存

这篇文章强调了处理复杂真实文档的困难,并推荐LlamaParse作为一款使用多个AI代理进行高效、可扩展和多模态文档解析的工具。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: AI文档解析的主要问题之一是,由于没有解决方案能达到100%准确率,很难判断某个…

X AI KOLs Timeline ↗ · 2026-09-11 缓存

LlamaParse 引入高投入置信度评分,以增强AI文档解析的准确性,实现敏感流程的人工审核和自动回退。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: 我们已训练新的模型用于复选框解析,这使您能够将任何尺寸和形状、已填写或未填写的复选框转换为...

X AI KOLs Timeline ↗ · 2026-09-10 缓存

LlamaIndex已训练新的AI模型,用于解析来自任何尺寸和形状表单的复选框,将它们转换为结构化JSON,以便在保险和税务处理等应用程序中进行编程使用。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0:我们在过去约 3 个月里全面大幅提升了文档解析能力。我们的 LlamaParse 成本……

X AI KOLs Timeline ↗ · 2026-09-04 缓存

LlamaIndex 在过去三个月里显著改进了 LlamaParse。在 ParseBench 基准测试中,其在复杂表格、图表和 grounding 方面的准确率提升了 10%–20%,同时每页成本仍控制在 0.4 美分以下。

0 人收藏 0 人点赞
#document-parsing

Jina-OCR-v1:采用推测解码与密集可验证奖励的高效文档解析

arXiv cs.CL ↗ · 2026-09-04 缓存

Jina-OCR-v1 是一款高效的端到端文档解析模型,通过结合推测解码与密集可验证奖励技术,可在低预算 GPU 上实现高精度与高处理速度,在 OmniDocBench v1.6 上得分 91.14,olmOCR-Bench 上得分 83.4。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: 我们很高兴推出Claude上的官方LlamaParse连接器!是的,Claude已经可以读取PDF,而且它可能…

X AI KOLs Timeline ↗ · 2026-08-31 缓存

官方的LlamaParse连接器已在Claude上推出,为复杂表格、表单和视觉元素提供增强的文档解析,具有高精度和规模化的成本效益。

0 人收藏 0 人点赞
#document-parsing

介绍Parse:大规模企业文档智能(5分钟阅读)

TLDR AI ↗ · 2026-08-28 缓存

Cohere推出了Parse,这是一种经济高效的视觉语言模型,用于处理大量企业文档并将其转化为结构化数据,为RAG和文档索引等用例提供高性能和可扩展性。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0:我们已在LlamaParse中引入了原生的、代理式电子表格提取功能。电子表格与PDF(或其他文档格式)截然不同……

X AI KOLs Timeline ↗ · 2026-08-27 缓存

LlamaParse引入了原生的代理式电子表格提取功能,使用经过调优的模型和框架进行模式引导的提取,能够将资产负债表等密集表格转换为清晰的结构化字段。

0 人收藏 0 人点赞
#document-parsing

@akshay_pachaar: 将任何PDF、图像、DOCX和PPTX转换为干净的markdown。解析单个PDF很简单。解析数百万个PDF才变得棘手。

X AI KOLs Timeline ↗ · 2026-08-23 缓存

Datalab发布了Marker v2,这是一个开源的文档解析管道,可以高效地将PDF、图像、DOCX和PPTX文件转换为markdown,支持超过90种语言,并在GPU上表现出高性能。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0: 我们在 LlamaParse 中构建了版本跟踪功能。您现在可以提取 Word 风格的修订跟踪和审阅者评论作为附加…

X AI KOLs Timeline ↗ · 2026-08-19 缓存

LlamaParse 已添加版本跟踪功能,以提取 Word 风格的修订跟踪和审阅者评论作为结构化元数据,使 AI 代理能够访问文档的完整修订历史记录,从而增强法律和金融等行业中的协作。

0 人收藏 0 人点赞
#document-parsing

@llama_index: 大多数解析器将修订跟踪视为噪音。结果:一个被删除的条款会作为活跃文本返回,而你的流水线读取…

X AI KOLs Timeline ↗ · 2026-08-18 缓存

LlamaParse 现在处理文档中的修订跟踪,提供最终状态的干净 markdown 以及编辑、删除和评论的结构化数据,解决解析器误解修订跟踪的问题。

0 人收藏 0 人点赞
#document-parsing

StarDoc-AI/TeleOCR

Hugging Face Models Trending ↗ · 2026-08-14 缓存

TeleOCR 是一个轻量级的开源视觉-语言模型,专为文档解析设计,统一处理数字文档和相机拍摄文档,并在基准测试中达到了最先进的性能。

0 人收藏 0 人点赞
#document-parsing

NaviDC-OCR:数字与相机捕获文档的解析导航

Hugging Face Daily Papers ↗ · 2026-08-13 缓存

NaviDC-OCR是一个统一的视觉-语言框架,通过变形感知学习和自适应采样提高文档解析准确性,在多个基准测试中达到了最先进的结果。

0 人收藏 0 人点赞
#document-parsing

@jerryjliu0:我们在 LlamaParse 中构建了一项新功能,可让你自动将任何复杂表单提取为结构化 JSON 输出…

X AI KOLs Timeline ↗ · 2026-08-07 缓存

LlamaIndex 推出了新的 LlamaParse 功能,可自动将复杂表单字段提取为结构化 JSON,无需预定义模式,从而简化文档表单处理。

0 人收藏 0 人点赞
#document-parsing

PaDoc: 基于布局的并行解码用于文档解析

Hugging Face Daily Papers ↗ · 2026-08-06 缓存

PaDoc 提出了一种面向端到端文档解析器的基于布局的并行解码方法,将布局解码与内容解码解耦,以减少解码深度并提高吞吐量。它在 OmniDocBenchFull 上取得了最先进的结果,并且相比顺序基线显著加速了推理。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈