@NielsRogge: 新Suyra OCR 2模型在http://paperswithcode.co上热度最高。另外,你能发现新的“Conferences”标签吗?
摘要
新Suyra OCR 2模型在Papers with Code上热度上升,并且网站上新增了“Conferences”标签。
新Suyra OCR 2模型在https://t.co/tOqTY2ZA6h上热度最高
另外,你能发现新的“Conferences”标签吗?👀 https://t.co/n6G7EqCmCT
查看缓存全文
缓存时间: 2026/06/01 03:06
新的 Suyra OCR 2 模型在 https://t.co/tOqTY2ZA6h 上成为最热门趋势。
另外,你看到新的“会议”标签了吗?👀 https://t.co/n6G7EqCmCT
相似文章
@vista8: 感觉百度的技术底子还是很硬的。 最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了! Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)…
百度开源的Unlimited OCR模型提出Reference Sliding Window Attention(R-SWA)机制,以30亿参数实现数十页文档连续解析,在GitHub和HuggingFace上获得极高关注。
@VikParuchuri:Marker 由新的 Surya OCR 2 模型驱动(https://github.com/datalab-to/surya…),该模型是在参数量低于 1B 的模型中得分最高的…
Datalab 宣布推出 Surya OCR 2,这是一个 650M 参数的 OCR 模型,在 olmOCR 基准测试中,参数量低于 1B 的模型里取得了最高准确率,同时速度快且支持多语言。
@VikParuchuri: 在这里获取 marker - https://github.com/datalab-to/marker… 快速开始:pip install marker-pdf,然后 marker /path/to/fold…
Marker 是一个开源工具,可以将 PDF、图像和其他文档格式快速准确地转换为 markdown、JSON、chunks 和 HTML,并可选择使用 LLM 增强。
DocOCR-Eval:一种无需真实标注、基于校正的OCR工具选择框架
DocOCR-Eval提出了一种无需标注的框架,采用校正和排序策略,在没有真实标签的情况下评估和选择OCR工具,并表明聚合多个多模态大语言模型能够改善与人工排序的一致性。
@denziideng: 告别手动截图翻译!overlay-translator 一键触发悬浮窗实时译文,玩游戏看漫画效率直接起飞 玩日服游戏、看日漫总被语言卡住?想实时看懂对话和UI却不想ROOT手机?手动截图翻译又麻烦又断片? 今天分享神器 overlay-t…
Overlay-translator(屏译)是一款开源 Android 实时屏幕翻译工具,无需 ROOT,通过悬浮窗在原画面上叠加中文翻译,支持游戏、漫画、视觉小说等多种场景,集成了多种 OCR 和翻译引擎,可离线使用。