标签
由Eric Lehman、F. Thomson Leighton和Albert R. Meyer合著的教材《Mathematics for Computer Science》的免费PDF版本可通过MIT开放课程获取,为计算机科学提供了必要的离散数学基础。
剑桥大学免费放出一批AI和机器学习经典教材PDF,涵盖入门到进阶,适合学习。
一条推文,分享2016年加州大学伯克利分校EECS技术报告中的一章,对其内容表示兴奋。
这篇论文提供了211页的纸笔练习合集,涵盖了机器学习的关键主题,包括线性代数、优化、图模型和变分推断,旨在作为教育资源。
PyMuPDF 1.28 新增了对 Markdown 的一流支持,允许通过 CSS 控制样式,从 Markdown 文本生成 PDF。
olmOCR 是来自Ai2的开源OCR工具,能够将PDF、扫描件和图像转换为干净的Markdown格式,旨在通过保留阅读顺序和处理复杂布局,为LLM流水线准备文档。
一个 Python 脚本,能自动解析 PDF 书籍内容,提取关键知识点并生成 Markdown 格式的摘要,旨在提升阅读和知识整理效率。
一条推文,推广一份关于构建自主LLM代理的38页PDF指南,提供免费资源学习关于自主性AI系统。
一款命令行工具和基于浏览器的工具,使用Go和WebAssembly,将PDF转换为仅包含图像的PDF,并模拟扫描效果,如倾斜、灰度、噪点和JPEG伪影。
一个包含15个组件的开源UI工具包,用于文档浏览(PDF、DOCX、XLSX),包括边界框引用、文件上传、电子签名和文件系统集成,基于MIT许可证发布。
Brevio提供了184个免费的基于浏览器的工具,用于PDF、图片、开发和AI任务,全部无需上传或注册。
book-to-skill 是一个开源工具,能将技术书籍、文档或收藏转化为结构化的 Agent 技能,支持 GitHub Copilot CLI、Amp 和 Claude Code 按需加载章节,解决知识遗忘和幻觉问题。
Typst 0.15 是开源排版系统的一个重要版本,引入了对可变字体、MathML 导出、多文件输出、多个参考文献列表和多个 PDF 标准的支持,同时还改进了文档和诊断功能。
本文介绍了一种技术,利用PDF规范中的替换文本属性,在PDF内部嵌入隐藏的Markdown结构,使得LLMs能够提取干净、结构化的数据,而人类看到的仍然是相同的视觉文档。
这条推文强调了一个 Paper Breakdown 功能,该功能允许用户跳转到 LLM 获取信息的 PDF 中的确切位置,提供简洁的答案以及直接链接到段落的链接,适用于单篇或多篇论文会话。
Extend UI 是一个面向现代文档应用的开源UI工具包,提供PDF、DOCX、XLSX和CSV文件的查看器,以及边界框引用、文件上传、电子签名等功能。
Extend UI 是一个开源组件库,包含 14 个用于文档代理的 UI 组件,包括 PDF、DOCX、XLSX 查看器,并支持边界框引用、文件上传和电子签名等功能。它采用 MIT 许可证,可在 shadcn 组件注册表中获取。
MiniMax 开源了四个 AI 文档生成技能(PPT、PDF、Excel、Word),无需 API Key 即可使用,旨在解决 AI 生成文档格式混乱、公式错误等问题。