knowledge-extraction

标签

Cards List
#knowledge-extraction

NLP驱动的翻译古印度医学文本的知识提取与主题分类

arXiv cs.CL · 2026-09-01 缓存

本文利用NLP技术,如NER和BERTopic,以及Neo4j,从翻译的古印度医学文本中提取、分类和可视化知识,提高可访问性和数字保存。

0 人收藏 0 人点赞
#knowledge-extraction

@tom_doerr: HyperExtract 使用大型语言模型将非结构化文档转换为结构化的知识图谱、超图和列表…

X AI KOLs Timeline · 2026-08-27 缓存

HyperExtract 是一个基于 LLM 的框架,用于将非结构化文档转换为结构化的知识图谱、超图和列表,简化知识提取和管理。

0 人收藏 0 人点赞
#knowledge-extraction

HERMES:用于地球科学中超长文档结构化知识提取的多代理框架

arXiv cs.CL · 2026-08-17 缓存

HERMES是一个可扩展的多代理框架,用于从地球科学中超长科学文档中提取结构化知识,实现了高准确度和相对于人工方法六倍的效率提升。

0 人收藏 0 人点赞
#knowledge-extraction

我把同一个 Ray Dalio 的视频看了 11 遍,却几乎什么都没记住。所以我把它变成了一个 Claude 技能。

Reddit r/AI_Agents · 2026-08-12

作者描述了如何构建一个 Claude 技能,从视频转录文本中提取 Ray Dalio 的大周期框架,使用结构化提取提示词并将输出组织到 SKILL.md 中。文章分享了他们将视频知识转化为可运行的 AI 工作流的逐步过程。

0 人收藏 0 人点赞
#knowledge-extraction

@RituWithAI: 有人刚刚搭建了一个工具,可以将任何书籍转化为 AI 代理可永久使用的技能。一条命令。任何 PDF、ePub、o…

X AI KOLs Timeline · 2026-07-29 缓存

book-to-skill 是一个开源工具,能将 PDF、ePub 和长文档转换为结构化的 SKILL.md 文件,供 Claude Code 和 Cursor 等 AI 编码代理使用,让代理在编码会话中永久应用书籍知识。

0 人收藏 0 人点赞
#knowledge-extraction

@tom_doerr: 人工智能驱动的逐页PDF知识提取与摘要 https://github.com/echohive42/AI-reads-books-page-by…

X AI KOLs Timeline · 2026-06-30 缓存

一种人工智能工具,用于逐页从PDF书籍中提取知识并生成摘要。

0 人收藏 0 人点赞
#knowledge-extraction

@Jolyne_AI: 一个能自动读懂 PDF 书籍的 Python 脚本:AI Reads Books。 把 PDF 丢进去,运行即可按页解析内容,抓取关键知识点,自动生成结构清晰的 Markdown 摘要。 GitHub:https://github.com…

X AI KOLs Timeline · 2026-06-28 缓存

一个 Python 脚本,能自动解析 PDF 书籍内容,提取关键知识点并生成 Markdown 格式的摘要,旨在提升阅读和知识整理效率。

0 人收藏 0 人点赞
#knowledge-extraction

@GitHub_Daily: 做量化研究的朋友,每天面对海量的金融研报和前沿论文,靠人工筛选有价值内容,无疑像大海捞针。 最近发现一个叫 QuantMind 的开源项目,专门做量化金融的智能知识提取与检索。 能自动抓取论文、新闻和博客等内容,把非结构化的文档转化为可查…

X AI KOLs Timeline · 2026-06-12 缓存

QuantMind 是一个开源的量化金融智能知识提取与检索框架,能够自动抓取论文、新闻等非结构化内容,构建可查询的结构化知识库,并支持自然语言检索。

0 人收藏 0 人点赞
#knowledge-extraction

从一亿乌克兰法院判决自动构建法律引用图:大规模提取、拓扑分析与本体驱动聚类

arXiv cs.CL · 2026-05-18 缓存

本文从1.007亿份乌克兰法院判决中构建了首个大规模引用图,提取了超过5亿条引用链接。研究表明,引用结构能够自动恢复法律领域边界,并以接近完美的准确度预测立法重要性。此外,本文将处理流程和数据作为开放资源发布。

0 人收藏 0 人点赞
#knowledge-extraction

经验压缩谱:统一LLM Agent的记忆、技能与规则

arXiv cs.CL · 2026-04-20 缓存

本文提出经验压缩谱,这是一个统一框架,将agent记忆、技能发现和基于规则的系统沿单一递增压缩轴集成(情景记忆5-20倍,程序性技能50-500倍,声明性规则1000倍以上)。工作识别出一个关键缺口——‘缺失对角线’——表明现有系统在固定压缩级别运行,缺乏自适应跨级别支持,并阐述了可扩展全谱agent学习系统的设计原则。

0 人收藏 0 人点赞
#knowledge-extraction

yifanfeng97/Hyper-Extract

GitHub Trending (daily) · 2026-06-18 缓存

Hyper-Extract 是一个开源命令行工具,利用大语言模型(LLMs)从非结构化文档中提取结构化知识,支持多种输出格式,如知识图谱和超图。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈