@rionaifantasy: 逆天了!34.5M 参数的 OCR,凭什么能赢过 235B 大模型? 说个离大谱的事,我以前一直以为 OCR 的未来一定会被越来越大的多模态大模型吃掉。 但看完百度文心这次发布的 PP-OCRv6,我有所改观了。 因为它走的不是“继续堆参…

X AI KOLs Timeline 模型

摘要

百度文心发布 PP-OCRv6,提供 Tiny/Small/Medium 三档模型,支持 50 多种语言;其中 Tiny 版仅 1.5MB 可在浏览器本地运行,单图预测最快 97ms,证明小型专用模型可在 OCR 任务上超越大模型。

逆天了!34.5M 参数的 OCR,凭什么能赢过 235B 大模型? 说个离大谱的事,我以前一直以为 OCR 的未来一定会被越来越大的多模态大模型吃掉。 但看完百度文心这次发布的 PP-OCRv6,我有所改观了。 因为它走的不是“继续堆参数”的路线,而是把 OCR 这件事做得更小、更快、更准、更适合本地部署。 PP-OCRv6 这次一口气推出 Tiny / Small / Medium 三档模型,支持 50 多种语言,覆盖浏览器、嵌入式设备到服务器。 最狠的是 Tiny 版:只有 1.5MB,可以直接跑在本地浏览器里,单图预测最快 97ms。
查看原文
查看缓存全文

缓存时间: 2026/06/16 23:43

逆天了!34.5M 参数的 OCR,凭什么能赢过 235B 大模型?

说个离大谱的事,我以前一直以为 OCR 的未来一定会被越来越大的多模态大模型吃掉。

但看完百度文心这次发布的 PP-OCRv6,我有所改观了。

因为它走的不是“继续堆参数”的路线,而是把 OCR 这件事做得更小、更快、更准、更适合本地部署。

PP-OCRv6 这次一口气推出 Tiny / Small / Medium 三档模型,支持 50 多种语言,覆盖浏览器、嵌入式设备到服务器。

最狠的是 Tiny 版:只有 1.5MB,可以直接跑在本地浏览器里,单图预测最快 97ms。

相似文章

@Fenng: HuggingFace、GitHub 四榜登顶,仅 5 天 Star 破万,百度 Unlimited OCR 跻身增长最快开源项目之一。 前两天时间线里看到不少人在说百度发布的 Unlimited-OCR。 其实 OCR 是百度的传统优势…

X AI KOLs Following

百度发布的 Unlimited-OCR 开源项目在 HuggingFace 和 GitHub 四榜登顶,5 天内 Star 破万。该模型采用 MoE 架构(3B 总参数、570M 激活参数),在长文档连续识别能力上表现突出,灵感来自人类抄书方式,也为大模型长期记忆管理提供了新思路。