@jerryjliu0: 文档解析中最难的部分之一是实现细粒度的归因和边界框。这让你能够将文本定位到…
摘要
LlamaParse 现在支持多层边界框(区域级、行级、词级),用于细粒度的文档文本归因,提高了发票、研究报告等文档的可审计性。
查看缓存全文
缓存时间: 2026/07/22 18:28
文档解析中最困难的部分之一,就是获取精细的文本归属和边界框。这能让你将每段文本精准定位到文档中的具体位置。
过去几个月,我们在改进边界框方面做了大量出色工作,现已提供多层级的边界框:区域级、行级和词级。无论最终用户是需要核查发票中的某个具体数字,还是想理解研究报告中的图表,你都能根据需求灵活获取文本归属。
现已在 LlamaParse 中上线:https://cloud.llamaindex.ai
登录
来源:https://login.llamaindex.ai/?client_id=client_01K39WZXHMNYBR1MSJSYAQRVFT&redirect_uri=https%3A%2F%2Fapi.cloud.llamaindex.ai%2Fapi%2Fv1%2Fauth%2Fworkos%2Fcallback&state=eyJyZWRpcmVjdCI6ICJodHRwczovL2Nsb3VkLmxsYW1haW5kZXguYWkvIn0%3D&authorization_session_id=01KY5HBBNEHMMF2J1WNGYV14DY
Logo
Logo
邮箱
或者
使用 Google 继续 (https://login.llamaindex.ai/api/login?provider=GoogleOAuth&state=eyJyZWRpcmVjdCI6ICJodHRwczovL2Nsb3VkLmxsYW1haW5kZXguYWkvIn0%3D&redirect_uri=https%3A%2F%2Fapi.cloud.llamaindex.ai%2Fapi%2Fv1%2Fauth%2Fworkos%2Fcallback&client_id=client_01K39WZXHMNYBR1MSJSYAQRVFT&source=signin&authorization_session_id=01KY5HBBNEHMMF2J1WNGYV14DY)
使用 Microsoft 继续 (https://login.llamaindex.ai/api/login?provider=MicrosoftOAuth&state=eyJyZWRpcmVjdCI6ICJodHRwczovL2Nsb3VkLmxsYW1haW5kZXguYWkvIn0%3D&redirect_uri=https%3A%2F%2Fapi.cloud.llamaindex.ai%2Fapi%2Fv1%2Fauth%2Fworkos%2Fcallback&client_id=client_01K39WZXHMNYBR1MSJSYAQRVFT&source=signin&authorization_session_id=01KY5HBBNEHMMF2J1WNGYV14DY)
使用 GitHub 继续 (https://login.llamaindex.ai/api/login?provider=GitHubOAuth&state=eyJyZWRpcmVjdCI6ICJodHRwczovL2Nsb3VkLmxsYW1haW5kZXguYWkvIn0%3D&redirect_uri=https%3A%2F%2Fapi.cloud.llamaindex.ai%2Fapi%2Fv1%2Fauth%2Fworkos%2Fcallback&client_id=client_01K39WZXHMNYBR1MSJSYAQRVFT&source=signin&authorization_session_id=01KY5HBBNEHMMF2J1WNGYV14DY)
还没有账号?注册 (https://login.llamaindex.ai/sign-up?state=eyJyZWRpcmVjdCI6ICJodHRwczovL2Nsb3VkLmxsYW1haW5kZXguYWkvIn0%3D&redirect_uri=https%3A%2F%2Fapi.cloud.llamaindex.ai%2Fapi%2Fv1%2Fauth%2Fworkos%2Fcallback&authorization_session_id=01KY5HBBNEHMMF2J1WNGYV14DY)
服务条款 (https://web.archive.org/web/20250304150948/https://www.llamaindex.ai/files/terms-of-service.pdf) 和 隐私政策 (https://web.archive.org/web/20250304150948/https://www.llamaindex.ai/files/privacy-notice.pdf)
相似文章
@jerryjliu0: 随着前沿模型(例如 Fable 5)不断拓展知识工作自动化的任务边界,人类越来越需要……
LlamaIndex 在 LlamaParse 中推出了细粒度边界框,支持对文档中每一个单词进行可视化引用,从而让用户能够人工审核确切的数字和图表。
@jerryjliu0:完全解决文档解析包括覆盖准确性、成本和延迟的帕累托曲线上的每一个点:高…
Jerry Liu 提出了一个涵盖准确性、成本和延迟权衡的文档解析框架,介绍了 LiteParse 作为一个面向 AI 智能体循环的开源低延迟解析工具,以及 LlamaParse 用于高精度模式。
@jerryjliu0:我们当前的核心使命是利用 AI 解决文档 OCR 问题。我们所有的产品线,从商业产品(LlamaParse)到……
LlamaIndex 对其官网进行了全面改版,并重申了以 AI 驱动文档 OCR 的核心使命,旗下产品涵盖商业产品 LlamaParse 以及开源工具 LiteParse 和 ParseBench。LlamaParse 采用基于 VLM 的智能文档理解技术,可大规模处理复杂版式、表格、图表及手写文字。
@jerryjliu0: 我们自豪地构建文档处理系统,不仅准确且成本低廉,还能大规模扩展到百万……
LlamaParse 现在为 Parse、Extract 和 Classify 任务提供延迟指标,包括排队时间、处理时间和总延迟的详细分解。这有助于用户监控和扩展其文档处理。
@jerryjliu0:我们创建了一个文档OCR路由器,能够估算每一页的复杂度,并以相应的模式进行解析……
LlamaIndex 推出了 Parse Gateway,这是一个页面级文档 OCR 路由器,能够估算每一页的复杂度,并将其路由到相应的解析层级(LiteParse 或 LlamaParse),在成本、延迟和质量之间取得平衡。