baidu

标签

Cards List
#baidu

@vista8: 感觉百度的技术底子还是很硬的。 最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了! Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)…

X AI KOLs Timeline · 2天前 缓存

百度开源的Unlimited OCR模型提出Reference Sliding Window Attention(R-SWA)机制,以30亿参数实现数十页文档连续解析,在GitHub和HuggingFace上获得极高关注。

0 人收藏 0 人点赞
#baidu

@DataScienceDojo: 一家中国公司刚刚开源了一个𝐎𝐂𝐑,它修复了大多数AI驱动OCR工具默默挣扎的一个问题:……

X AI KOLs Timeline · 3天前 缓存

Unlimited-OCR,一家中国公司新发布的开源OCR模型,解决了AI OCR工具中常见的内存增长问题——无论文档多长,内存使用都保持平稳,从而能够在32K上下文长度下一次性读取数十页。它采用MIT许可,拥有30亿参数,支持多语言,并且在GitHub上已经广受欢迎。

0 人收藏 0 人点赞
#baidu

@S0N_IA: | 中国已终结OCR业务——一个花生大小的30亿参数模型可以一口气读完整份100页的PDF……

X AI KOLs Timeline · 4天前 缓存

百度发布Unlimited-OCR,一个30亿参数的开源模型,拥有32K上下文窗口,可一口气读完整份100页PDF,准确率达93%,且完全本地运行。该模型在Hugging Face上已有190万下载量,却鲜有关注。

0 人收藏 0 人点赞
#baidu

@Fenng: HuggingFace、GitHub 四榜登顶,仅 5 天 Star 破万,百度 Unlimited OCR 跻身增长最快开源项目之一。 前两天时间线里看到不少人在说百度发布的 Unlimited-OCR。 其实 OCR 是百度的传统优势…

X AI KOLs Following · 2026-06-29 缓存

百度发布的 Unlimited-OCR 开源项目在 HuggingFace 和 GitHub 四榜登顶,5 天内 Star 破万。该模型采用 MoE 架构(3B 总参数、570M 激活参数),在长文档连续识别能力上表现突出,灵感来自人类抄书方式,也为大模型长期记忆管理提供了新思路。

0 人收藏 0 人点赞
#baidu

@KaichaoYou:来自百度的一款出色的OCR模型!如果你看到OCR模型有多受欢迎,你会感到惊讶,它们有时甚至比顶尖的LLM还更受欢迎……

X AI KOLs Timeline · 2026-06-28 缓存

百度的Unlimited-OCR模型采用了Reference Sliding Window Attention技术,现已获得vLLM支持,能够以恒定内存消耗高效地一次性解析整本书籍。

0 人收藏 0 人点赞
#baidu

@_akhaliq: 百度刚刚发布了 Unlimited-OCR

X AI KOLs Following · 2026-06-23 缓存

百度发布了 Unlimited-OCR,这是一款无使用限制的光学字符识别服务。

0 人收藏 0 人点赞
#baidu

@vanstriendaniel: OCR模型又来了!百度公司的Unlimited-OCR是其中比较有趣的一个。你可以无需太多…

X AI KOLs Following · 2026-06-23 缓存

这篇文章展示了如何在Hugging Face Jobs上将百度的Unlimited-OCR模型作为临时的、兼容OpenAI的端点提供服务,支持多页文档解析,具有表格转HTML和公式转LaTeX提取等功能。

0 人收藏 0 人点赞
#baidu

Unlimited OCR: 一次性长程解析

Hacker News Top · 2026-06-23 缓存

百度发布Unlimited-OCR,这是一个基于Deepseek-OCR构建的开源模型,用于一次性长程文档解析,支持单张图片、多页文档和PDF。

0 人收藏 0 人点赞
#baidu

@BaiduAI_News: 我们正在开源Unlimited OCR——专为一次性读取长文档而构建。总参数3B,仅500M激活…

X AI KOLs Timeline · 2026-06-23 缓存

百度开源Unlimited OCR,一个3B参数模型(500M激活参数),使用Reference Sliding Window Attention(R-SWA)一次性读取长文档,在OmniDocBench上取得最先进的SOTA结果。

0 人收藏 0 人点赞
#baidu

@ErickSky: 百度刚刚打破了当前OCR最大的限制之一。Unlimited-OCR一次性处理整个文档…

X AI KOLs Timeline · 2026-06-23 缓存

百度发布了Unlimited-OCR,它可以一次性处理整个文档而无需分块,克服了当前OCR技术的一个主要限制。

0 人收藏 0 人点赞
#baidu

@geekbb: 百度开源的视觉语言模型 OCR 项目,在 DeepSeek-OCR 基础上做了升级,主打一次性解析超长文档。模型有两种推理模式:gundam 模式用来对付单张图里的密集文字,base 模式处理多页或 PDF。 https://github…

X AI KOLs Timeline · 2026-06-23 缓存

百度开源了视觉语言模型Unlimited-OCR,基于DeepSeek-OCR升级,支持一次性解析超长文档,提供gundam(单图密集文字)和base(多页/PDF)两种推理模式。

0 人收藏 0 人点赞
#baidu

@berryxia: 卧槽,这一波直接把DeepSeek的“墙角挖到了啊”! 昨晚看到HuggingFace刷到这个有意思的OCR开源模型和原来背后有趣的故事。 这个OCR模型直接与传统的OCR模型完全不同! 光着速度和精准度真的就无敌了~~ 先说说背景,熟悉…

X AI KOLs Timeline · 2026-06-23 缓存

百度开源了Unlimited OCR模型,采用R-SWA注意力机制,可一次性处理数百页文档,无需分页,KV Cache恒定。该模型创新性地借鉴了人类抄书时的注意力模式,并与DeepSeek OCR有技术渊源,引发了对人才流动的关注。

0 人收藏 0 人点赞
#baidu

@GoSailGlobal: 现在的 OCR 处理几十页文档,是逐页跑的 每翻一页,记忆清零一次 百度今天悄悄在 GitHub 和 HuggingFace 开源了一个模型,叫 Unlimited OCR,它的灵感,来自人类抄书: - 你抄一本书,不会每写一个字就把前面…

X AI KOLs Timeline · 2026-06-22 缓存

百度开源了 Unlimited OCR 模型,采用参考滑动窗口注意力(R-SWA)机制,实现了对长达 32K 上下文的一次性文档解析,无需逐页推理。

0 人收藏 0 人点赞
#baidu

@paulwalker99318: 晚点LateTask这篇访谈的信息量非常大,关于百度美研、Scaling Law、OpenAI、Anthropic、Cerebras的往事。 > "Dario 能进百度,其实是他职业生涯里很重要的一步。他是 Greg Diamos 招进来…

X AI KOLs Timeline · 2026-06-22 缓存

这是一条对晚点LateTask访谈的总结,回顾了百度美研在AI领域的早期布局,包括投资Cerebras、差点投资OpenAI和Anthropic,以及多位人才从百度流向这些公司等历史细节。

0 人收藏 0 人点赞
#baidu

Unlimited OCR 的工作原理

Hugging Face Daily Papers · 2026-06-22 缓存

Unlimited OCR 引入了 Reference Sliding Window Attention,以消除长序列 OCR 任务中不断增长的内存消耗,从而能够在单次前向传播中高效转录多页文档。

0 人收藏 0 人点赞
#baidu

baidu/Unlimited-OCR

Hugging Face Models Trending · 2026-06-19 缓存

百度发布了Unlimited-OCR,一种用于一次性长程文档解析的新模型,基于Deepseek-OCR构建。它支持通过Hugging Face Transformers和SGLang进行单图像和多页/PDF解析。

0 人收藏 0 人点赞
#baidu

@smithandai: 百度默默无闻出了这么好的产品啊,这个真的是刚需,我每次翻译论文都头痛那些密密麻麻的数字!

X AI KOLs Timeline · 2026-06-16

用户称赞百度推出的一款产品,能够有效解决翻译论文时数字处理困难的痛点,认为这是刚需。

0 人收藏 0 人点赞
#baidu

@rionaifantasy: 逆天了!34.5M 参数的 OCR,凭什么能赢过 235B 大模型? 说个离大谱的事,我以前一直以为 OCR 的未来一定会被越来越大的多模态大模型吃掉。 但看完百度文心这次发布的 PP-OCRv6,我有所改观了。 因为它走的不是“继续堆参…

X AI KOLs Timeline · 2026-06-16 缓存

百度文心发布 PP-OCRv6,提供 Tiny/Small/Medium 三档模型,支持 50 多种语言;其中 Tiny 版仅 1.5MB 可在浏览器本地运行,单图预测最快 97ms,证明小型专用模型可在 OCR 任务上超越大模型。

0 人收藏 0 人点赞
#baidu

@AdinaYakup: 百度 @PaddlePaddle 发布 PP-OCRv6:tiny 1.5M / small 7.7M / medium 34.5M,支持 48+ 种语言,支持手写/……

X AI KOLs Following · 2026-06-11 缓存

百度 PaddlePaddle 发布了 PP-OCRv6,一款支持 48+ 种语言的 OCR 模型,提供 tiny(1.5M)、small(7.7M)和 medium(34.5M)三种尺寸,针对边缘部署进行了优化,可处理手写、印刷、工业、屏幕和卡片文字。

0 人收藏 0 人点赞
#baidu

@10xmylife: 相比于国外,国内的独立站生态是不是很差? 如果是的话,原因是什么? 大家去搜一个品牌,会在微信、微博、抖音、小红书、淘宝等平台搜,就是很少会在百度搜 商家也基本都依托平台,很少会自己做官网的 我觉得百度本身烂是一个原因,但是肯定还有更深层…

X AI KOLs Following · 2026-05-21 缓存

讨论中国独立站(品牌自建官网)生态为何弱于国外,认为用户主要在微信、微博、抖音等平台搜索品牌而非百度,且商家依赖平台而非自建官网。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈