@tom_doerr: 将图像和PDF转换为Markdown,无需OCR https://github.com/NanoNets/docext
摘要
docext是一个本地部署的工具包,无需OCR即可将图像和PDF转换为Markdown,利用视觉语言模型。它还引入了Nanonets-OCR-s,一个紧凑的3B参数模型,用于高效的图像到Markdown转换。
查看缓存全文
缓存时间: 2026/05/08 17:36
docext - 一个本地部署的文档信息提取与基准测试工具包。
相似文章
@tom_doerr: Converts web URLs, PDFs, and media files into clean Markdown, automatically stripping ads and navigation while supporti…
PullMD is a self-hosted URL-to-Markdown service for humans and AI agents, converting web pages, PDFs, and media files into clean Markdown, with support for an MCP server and Claude Code skill.
@HowToPrompt__: 有人开源了一个工具,每秒可将PDF转换为Markdown,速度达122页。→ PDF、DOCX、PPTX、XLSX、EPUB、图像…
一个开源工具可将PDF、DOCX、PPTX、XLSX、EPUB及图像转换为Markdown,速度达122页/秒,支持表格、公式和表单,可在GPU、CPU或Mac上运行。
@tom_doerr: 在本地索引PDF和Markdown文件以进行语义搜索和AI增强。 https://github.com/joelhooks/pdf-brain…
此工具在本地对PDF和Markdown文件进行索引,用于语义搜索和AI增强,使用Ollama进行嵌入和LLM处理,并提供CLI和MCP服务器以便与AI助手集成。
将所有内容转换为 Markdown
Klartext 是一款免费、注重隐私的在线工具,可将 PDF、扫描件、照片、Word、Excel 和 PowerPoint 文件转换为 Markdown(以及 JSON),整个过程完全在其自有服务器上进行,24 小时后自动删除,且不依赖任何外部 AI/OCR 服务。
NuExtract3发布:面向Markdown、OCR和结构化提取的开放权重4B视觉语言模型(可自行托管)[P]
Numind发布了NuExtract3,这是一个基于Qwen3.5-4B的4B开放权重视觉语言模型,专为将文档图像转换为Markdown、OCR和结构化数据提取而设计。该模型采用Apache-2.0许可证,可自行托管,并提供量化版本以适应低显存环境。