document-ai

标签

Cards List
#document-ai

@DataScienceDojo: 一家中国公司刚刚开源了一个𝐎𝐂𝐑,它修复了大多数AI驱动OCR工具默默挣扎的一个问题:……

X AI KOLs Timeline · 4天前 缓存

Unlimited-OCR,一家中国公司新发布的开源OCR模型,解决了AI OCR工具中常见的内存增长问题——无论文档多长,内存使用都保持平稳,从而能够在32K上下文长度下一次性读取数十页。它采用MIT许可,拥有30亿参数,支持多语言,并且在GitHub上已经广受欢迎。

0 人收藏 0 人点赞
#document-ai

MonkeyOCRv2: 用于文档AI的视觉-文本基础模型

Hugging Face Daily Papers · 2026-07-13 缓存

MonkeyOCRv2是一个用于文档AI的视觉-文本基础模型,在涵盖17种语言的1.13亿张图像的大规模语料库上进行了预训练,采用联合图像到文本生成和像素级文档重建。它在文档解析和理解任务上取得了最先进的结果,以更小的视觉编码器超越了之前的模型。

0 人收藏 0 人点赞
#document-ai

datalab-to/lift

Hugging Face Models Trending · 2026-06-19 缓存

Datalab 发布了 lift,一个通过模式约束解码从 PDF 和图像中提取结构化 JSON 的模型,支持本地推理和托管推理选项。

0 人收藏 0 人点赞
#document-ai

将文档AI投入生产:面向OCR与LLM管道的微服务架构

arXiv cs.AI · 2026-05-20 缓存

本文提出了一种面向生产级文档AI管道的微服务架构,该架构结合了分类、OCR和LLM提取,分享了设计决策和批量分析洞察,揭示了OCR(而非LLM解析)主导了延迟。

0 人收藏 0 人点赞
#document-ai

PaddlePaddle/PaddleOCR

GitHub Trending (daily) · 2026-06-05

PaddleOCR是一个功能强大、轻量级的OCR工具包,可将PDF和图像转换为结构化数据,适用于AI应用,支持100多种语言,旨在连接文档与大语言模型。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈