@CoderDaMing: 中国开源了一个花生大小的OCR,能一次性解析整个100页PDF。 叫'Unlimited-OCR'。仅3B参数。本地运行。 其他OCR工具都是逐页切割文档,容易丢失上下文。这个一次性读取整个文档。 → 单次'长视野'解析(32K上下文窗口…

X AI KOLs Timeline 模型

摘要

中国开源了仅3B参数的OCR模型Unlimited-OCR,能一次性解析整个100页PDF,支持本地运行,准确率93%,完全免费开源。

中国开源了一个花生大小的OCR,能一次性解析整个100页PDF。 叫'Unlimited-OCR'。仅3B参数。本地运行。 其他OCR工具都是逐页切割文档,容易丢失上下文。这个一次性读取整个文档。 → 单次'长视野'解析(32K上下文窗口) → 开箱即用多语言支持 → 标准基准测试93%准确率(+6超基线) → 40页以上<0.11错误率 → 100%本地运行 → 支持Transformers、vLLM、SGLang、Docker、Ollama、llama.cpp 传统云端OCR(Textract、Google Vision、Azure)成本1.5-15美元/千页。 这个在你的机器上运行。永久免费。 百度开发它来推进'DeepSeek-OCR'。已在HuggingFace获190万次下载,多数人还不知道它。 100%开源。
查看原文
查看缓存全文

缓存时间: 2026/07/20 17:31

中国开源了一个花生大小的OCR,能一次性解析整个100页PDF。

叫’Unlimited-OCR’。仅3B参数。本地运行。

其他OCR工具都是逐页切割文档,容易丢失上下文。这个一次性读取整个文档。

→ 单次’长视野’解析(32K上下文窗口) → 开箱即用多语言支持 → 标准基准测试93%准确率(+6超基线) → 40页以上<0.11错误率 → 100%本地运行 → 支持Transformers、vLLM、SGLang、Docker、Ollama、llama.cpp

传统云端OCR(Textract、Google Vision、Azure)成本1.5-15美元/千页。

这个在你的机器上运行。永久免费。

百度开发它来推进’DeepSeek-OCR’。已在HuggingFace获190万次下载,多数人还不知道它。

100%开源。

相似文章

baidu/Unlimited-OCR

Hugging Face Models Trending

百度发布了Unlimited-OCR,一种用于一次性长程文档解析的新模型,基于Deepseek-OCR构建。它支持通过Hugging Face Transformers和SGLang进行单图像和多页/PDF解析。