@vista8: 感觉百度的技术底子还是很硬的。 最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了! Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)…

X AI KOLs Timeline 模型

摘要

百度开源的Unlimited OCR模型提出Reference Sliding Window Attention(R-SWA)机制,以30亿参数实现数十页文档连续解析,在GitHub和HuggingFace上获得极高关注。

感觉百度的技术底子还是很硬的。 最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了! Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)机制,不用传统的“逐页解析+结果拼接”方法,通过借鉴人类阅读和抄长文档的工作方式,把解码阶段 KV Cache 控制在恒定规模,仅用30亿参数模型,实现数十页文档一次连续解析。 上个月开源的 Unlimited OCR,发布第二天就冲上 GitHub Trending 和 HuggingFace 模型下载趋势榜双第一。 如今项目 GitHub Star 已突破 1.65 万,HuggingFace 下载量超 224 万,再一次登上Trending,目前已经位列第二,并再次超过 GLM-5.2。 作为大模型训练数据清洗的基建型项目,Unlimited OCR 吸引了全球大量开发者的关注。 #无限OCR #UnlimitedOCR #百度 #文心大模型 #文心
查看原文
查看缓存全文

缓存时间: 2026/07/22 18:35

感觉百度的技术底子还是很硬的。

最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了!

Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)机制,不用传统的“逐页解析+结果拼接”方法,通过借鉴人类阅读和抄长文档的工作方式,把解码阶段 KV Cache 控制在恒定规模,仅用30亿参数模型,实现数十页文档一次连续解析。

上个月开源的 Unlimited OCR,发布第二天就冲上 GitHub Trending 和 HuggingFace 模型下载趋势榜双第一。

如今项目 GitHub Star 已突破 1.65 万,HuggingFace 下载量超 224 万,再一次登上Trending,目前已经位列第二,并再次超过 GLM-5.2。

作为大模型训练数据清洗的基建型项目,Unlimited OCR 吸引了全球大量开发者的关注。

#无限OCR #UnlimitedOCR #百度 #文心大模型 #文心

相似文章

@berryxia: 卧槽,这一波直接把DeepSeek的“墙角挖到了啊”! 昨晚看到HuggingFace刷到这个有意思的OCR开源模型和原来背后有趣的故事。 这个OCR模型直接与传统的OCR模型完全不同! 光着速度和精准度真的就无敌了~~ 先说说背景,熟悉…

X AI KOLs Timeline

百度开源了Unlimited OCR模型,采用R-SWA注意力机制,可一次性处理数百页文档,无需分页,KV Cache恒定。该模型创新性地借鉴了人类抄书时的注意力模式,并与DeepSeek OCR有技术渊源,引发了对人才流动的关注。

@Fenng: HuggingFace、GitHub 四榜登顶,仅 5 天 Star 破万,百度 Unlimited OCR 跻身增长最快开源项目之一。 前两天时间线里看到不少人在说百度发布的 Unlimited-OCR。 其实 OCR 是百度的传统优势…

X AI KOLs Following

百度发布的 Unlimited-OCR 开源项目在 HuggingFace 和 GitHub 四榜登顶,5 天内 Star 破万。该模型采用 MoE 架构(3B 总参数、570M 激活参数),在长文档连续识别能力上表现突出,灵感来自人类抄书方式,也为大模型长期记忆管理提供了新思路。