@thesupermanmx: 中国刚刚开源了一款OCR模型,可一次性转录整本书。它名为Unlimited OCR。构建于…

X AI KOLs Timeline 模型

摘要

中国开源了Unlimited OCR,这是一款基于DeepSeek OCR的OCR模型,可以一次性转录整本书,内存使用恒定,在标准解析基准上达到93%的准确率。

中国刚刚开源了一款OCR模型,能一次性转录整本书。 它叫做Unlimited OCR。基于DeepSeek OCR构建,并对注意力机制做了一个关键修复,因此无论文档多长,内存占用都保持稳定。 → 标准解析基准达到93%(比基线提高6%) → 40页以上的错误率低于0.11 → 每次可处理数十页 → 速度稳定,而旧模型速度会降低35% 100%开源。
查看原文
查看缓存全文

缓存时间: 2026/06/28 08:04

中国刚刚开源了一个OCR模型,可一次性转录整本书。

它叫Unlimited OCR。基于DeepSeek OCR构建,关键修复了注意力机制,无论文档多长,内存都保持稳定。

→ 标准解析基准测试达93%(较基线提升6%) → 40页以上的稿件错误率低于0.11 → 单次可处理数十页 → 速度稳定,旧模型则会减慢35%

100%开源。

相似文章

@DataScienceDojo: 一家中国公司刚刚开源了一个𝐎𝐂𝐑,它修复了大多数AI驱动OCR工具默默挣扎的一个问题:……

X AI KOLs Timeline

Unlimited-OCR,一家中国公司新发布的开源OCR模型,解决了AI OCR工具中常见的内存增长问题——无论文档多长,内存使用都保持平稳,从而能够在32K上下文长度下一次性读取数十页。它采用MIT许可,拥有30亿参数,支持多语言,并且在GitHub上已经广受欢迎。