document-processing

标签

Cards List
#document-processing

DokBot

Product Hunt ↗ · 3天前 缓存

DokBot 是一个AI聊天机器人产品,可将文档文件转化为网站客服机器人,全天候解答用户问题,并处理未解决的邮件。

0 人收藏 0 人点赞
#document-processing

以更低成本分割文档:基于LLM的页面流分割的Multi-Split边界决策

arXiv cs.AI ↗ · 5天前 缓存

本文提出Multi-Split边界决策(MSBD),用于降低基于大语言模型的零样本页面流分割中的推理成本,在适当窗口大小下展示效率提升并保持准确性。

0 人收藏 0 人点赞
#document-processing

将PDF转换为播客

Reddit r/artificial ↗ · 6天前

PaperPod是一项将PDF文档转换为播客节目的服务,能在约一分钟内生成一个20分钟的双主持人节目,无需GPU或录音室设备。

0 人收藏 0 人点赞
#document-processing

@grgerwcwetwet: 这是一个非常推荐的用于小组学习的Agent技能,值得安装:learn-from-materials。它直…

X AI KOLs Timeline ↗ · 2026-09-19 缓存

learn-from-materials Agent技能将PDF、EPUB、Word文档和PPT转换为具有源追踪和知识库构建功能的交互式学习网站。

0 人收藏 0 人点赞
#document-processing

Typst 取得重大进展

Lobsters Hottest ↗ · 2026-09-18 缓存

Typst,一个定位为 LaTeX 替代品的排版系统,发布了版本 0.15,包含新功能,支持可变字体、MathML 和多个参考文献列表。

0 人收藏 0 人点赞
#document-processing

从像素到键值对:在噪声文档设置中基于LLM的键值提取综合基准测试

arXiv cs.CL ↗ · 2026-09-17 缓存

本文介绍了一个综合基准测试,用于评估大型语言模型在OCR噪声下进行文档键值提取的能力,揭示了显著的性能下降,并强调了需要联合优化OCR质量和LLM推理。

0 人收藏 0 人点赞
#document-processing

用于序列恢复的证据对齐离散专家局部组合

arXiv cs.AI ↗ · 2026-09-10 缓存

本文引入了证据对齐的局部组合,这是一种通过从损坏观察的边缘证据推断冻结领域专家的软权重来恢复损坏文档的方法,在没有标注数据的情况下实现了跟踪专家区域的高准确率。

0 人收藏 0 人点赞
#document-processing

@GithubProjects: TextGen 在您自己的计算机上运行强大的AI模型,完全离线且私密。- 无需跟踪、无需互联网、无需 …

X AI KOLs Timeline ↗ · 2026-09-02 缓存

TextGen 是一款工具,让用户能在自己的电脑上本地运行强大的AI模型,完全隐私、离线可用,并通过简单的下载和设置支持文本、图像和文档。

0 人收藏 0 人点赞
#document-processing

@weaviate_io:在搜索PDF之前,我们不再要求它们转换为文本。通过后期交互多向量检索,您能够……

X AI KOLs Following ↗ · 2026-09-01 缓存

Weaviate 引入了一种无需文本提取即可搜索PDF的方法,通过后期交互多向量检索将每一页作为图像嵌入,在NVIDIA投资者演示文稿中进行了演示。

0 人收藏 0 人点赞
#document-processing

构建金融文档高精度语义证据/RAG系统——寻求反馈

Reddit r/AI_Agents ↗ · 2026-08-26

本文概述了一个用于金融文档的高精度语义证据和RAG系统的多门架构,强调了可追溯性、对账和混合检索,并征求对其设计的反馈。

0 人收藏 0 人点赞
#document-processing

@trueventures: 即将出席旧金山 Connected Stack 大会 — @jerryjliu0,@llama_index 的首席执行官兼联合创始人,由 @GreylockVC 推荐。LlamaIndex i…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

旧金山 Connected Stack 大会将汇聚来自 Anthropic 和 LlamaIndex 等公司的 AI 行业领袖,专注于企业级 AI 和 AI 代理的文档基础设施。

0 人收藏 0 人点赞
#document-processing

@jerryjliu0:当前代理框架(Codex, Cowork)的最新RAG趋势是进行两次文档处理以解决…

X AI KOLs Timeline ↗ · 2026-08-23 缓存

文章讨论了AI代理的两阶段文档处理趋势,其中快速OSS阶段实现高效检索,基于VLM的阶段确保准确性,推广Llama Index的LiteParse和LlamaParse工具以提高成本和性能。

0 人收藏 0 人点赞
#document-processing

@jerryjliu0:我们LlamaParse中的"agentic plus"提取器非常适合从长文档中提取大量字段(例如,10k-100k+字段…

X AI KOLs Following ↗ · 2026-08-15 缓存

Jerry Liu介绍了ExtractBench,并重点介绍了LlamaParse中的'agentic plus'提取器,用于处理长文档中的大量字段,基准测试结果可在ExtractBench上查看。

0 人收藏 0 人点赞
#document-processing

@jerryjliu0:我们不是Palantir,但我们在文档处理方面确实对评估和爬山优化思考很多。如果你真的有很…

X AI KOLs Following ↗ · 2026-08-09 缓存

Jerry Liu 推广 LlamaParse 和 LlamaAgents,用于大规模文档提取,强调 LLM 评估和爬山优化以提高准确性和成本效益。他还将 FDE 工作与评估和 RL 环境联系起来。

0 人收藏 0 人点赞
#document-processing

@DanKornas:传统的以文本为中心的RAG系统无法有效处理现代文档中的图像、表格、公式、图表以及多媒体…

X AI KOLs Timeline ↗ · 2026-08-03 缓存

RAG-Anything 是一个基于 LightRAG 构建的多模态文档处理 RAG 系统,它解析文档、构建多模态知识图谱,并使用混合向量-图检索来回答问题。

0 人收藏 0 人点赞
#document-processing

Xberg v1 发布

Reddit r/LocalLLaMA ↗ · 2026-08-02

Xberg v1 作为 Kreuzberg 的继任者发布,是一个高性能内容智能框架,支持 101 种文档格式、367 种代码/数据类型、音视频转录和 URL 抓取,拥有纯 Rust 的 PDF 和 OCR 后端、多种语言绑定以及移动端/WASM 支持。

0 人收藏 0 人点赞
#document-processing

IDP AutoOpt:文档处理流水线配置的智能体驱动优化

arXiv cs.AI ↗ · 2026-07-31 缓存

本文介绍了IDP AutoOpt,一个自主的LLM智能体,用于优化智能文档处理流水线配置,以更低的成本达到或超过人类专家的准确率,并将配置时间从数周缩短至两小时以内。

0 人收藏 0 人点赞
#document-processing

@jerryjliu0: 我们很高兴为LlamaParse推出官方的批量解析体验。不再是一次一个文件地访问我们的API,而是……

X AI KOLs Following ↗ · 2026-07-30 缓存

LlamaIndex宣布为LlamaParse推出官方批量解析体验,允许用户通过专用界面一次解析多达10,000个文件,并支持批量审计和故障检查,无需再编写自定义异步脚本。

0 人收藏 0 人点赞
#document-processing

@PrajwalTomar_: 一个完全离线的AI刚刚阅读了超过4000页解密的UFO文件,并回答了关于它们的问题,且附有引用…

X AI KOLs Timeline ↗ · 2026-07-30 缓存

一个完全离线的AI使用OCR和向量数据库读取了超过4000页解密的UFO文件,在本地提供带引用的答案,无需云端或API密钥。

0 人收藏 0 人点赞
#document-processing

DocAnnot——利用生成式AI驱动的自动标注加速关键信息提取数据集的创建

arXiv cs.CL ↗ · 2026-07-29 缓存

介绍DocAnnot框架,该框架使用大型视觉语言模型、OCR以及一种空间感知的上下文匹配算法,自动生成用于文档关键信息提取的训练数据集,减少人工标注工作量。在CORD和SROIE基准测试中评估,取得了合理的F1分数,并实现了高效的人工验证。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈