OCR It – 从无法复制的文档中提取文本,为您的 LLM 服务
摘要
OCR It 是一款 Chrome 扩展,使用本地 OCR 从无法复制的文档中提取文本,旨在帮助用户为 Claude 或 ChatGPT 等 LLM 准备内容。
暂无内容
查看缓存全文
缓存时间: 2026/08/24 07:46
OCR 文本识别 一次性框选区域,每页按下快捷键,即可提取整本书的文本内容。
相似文章
@hasantoxr: 我找到了为LLM时代打造的OCR工具。它叫olmOCR。olmOCR可以处理PDF、扫描件、PNG和JPEG,并将其转…
olmOCR 是来自Ai2的开源OCR工具,能够将PDF、扫描件和图像转换为干净的Markdown格式,旨在通过保留阅读顺序和处理复杂布局,为LLM流水线准备文档。
abiruyt/text-extract-ocr
abiruyt/text-extract-ocr 是一个开源OCR模型,可在Replicate上使用,在CPU上运行,成本低且推理速度快。
@DanKornas:Dicklesworthstone/llm_aided_ocr 使用LLM驱动的文本校正对扫描PDF进行OCR GitHub:存档:
llm_aided_ocr 是一个 GitHub 项目,它对扫描的 PDF 执行 OCR,并使用 LLM 来纠正和改进提取的文本。
PaddlePaddle/PaddleOCR
PaddleOCR是一个功能强大、轻量级的OCR工具包,可将PDF和图像转换为结构化数据,适用于AI应用,支持100多种语言,旨在连接文档与大语言模型。
@atomic_chat_hq: Mistral OCR 4 将手写的微积分考试卷转化为干净的LaTeX!我们给它一张手写考试页面的照片。这…
Mistral OCR 4 将手写的微积分考试卷转换为干净的LaTeX,准确读取公式并处理图表,但不会重新绘制它们。该模型提供带有边界框和置信度分数的结构化输出,支持170种语言。