extraction

标签

Cards List
#extraction

@MaxForAI: 刚刚,一篇可能会引起大模型圈地震的论文发表了! 研究人员第一次系统性地从 OpenAI、Anthropic、Google 的闭源模型里,大规模“偷”出了真正的隐藏思维链。 然后,他们顺手拿这些思维链去研究了 Kimi K3、GLM-5.2…

X AI KOLs Timeline · 2026-08-11 缓存

研究人员首次系统性地从OpenAI、Anthropic、Google的闭源模型中提取隐藏思维链,利用API加密兼容漏洞让较弱模型解密,从而绕过CoT蒸馏防护,并研究了Kimi K3、GLM-5.2、DeepSeek等开源模型。

0 人收藏 0 人点赞
#extraction

@llama_index:你不需要视觉模型就能知道 PDF 中有复选框。LiteParse 现在可以直接从……提取结构化数据

X AI KOLs Following · 2026-08-03 缓存

LiteParse 现在支持从 PDF 中提取结构化数据——表单字段、复选框状态、注释、图像、矢量图形和词级边界框——无需视觉模型,并提供复杂度信号,将更困难的页面路由到 LlamaParse 等工具。

0 人收藏 0 人点赞
#extraction

@vartekxx: Boris Cherny 刚刚发布了关于图工程的7页PDF——如何用4个Claude提示词替代4个训练好的ML模型 关键是:…

X AI KOLs Timeline · 2026-07-23 缓存

Boris Cherny 发布了一篇关于图工程的7页PDF,展示了如何通过构建一个持久的代理知识图谱,使用四个Claude提示词替代训练好的ML模型,步骤包括提取、解析、总结和查询。

0 人收藏 0 人点赞
#extraction

@EXM7777: https://x.com/EXM7777/status/2074158459545854232

X AI KOLs Timeline · 2026-07-06 缓存

文章概述了五种工作流程,用于在Fable 5(前沿AI模型)从订阅制转向按Token计费之前,从中提取智能信息,重点捕捉廉价模型无法复制的判断力和知识。

0 人收藏 0 人点赞
#extraction

模型安全风险(提取、投毒)在生产中是否真的被测试?[R]

Reddit r/MachineLearning · 2026-06-23

讨论关于 ML 团队是否真的在生产中测试模型安全风险(如提取和投毒),并指出模型的安全审查落后于常规软件。

0 人收藏 0 人点赞
#extraction

@DataChaz: 混乱文档输入,复杂知识图谱输出,仅需一条命令行。如果你的流水线只是将数据编译成通用……

X AI KOLs Timeline · 2026-06-17 缓存

Hyper-Extract 是一个开源框架,可将混乱文档转换为类型化知识结构,支持多种图谱架构(如 GraphRAG、LightRAG 和 KG-Gen),拥有 10 多种提取引擎和 80 多个面向不同领域的 YAML 模板。

0 人收藏 0 人点赞
#extraction

Taste Lab

Product Hunt · 2026-06-13

Taste Lab 是一款提取网站设计DNA的工具,让用户能够分析和复制设计元素。

0 人收藏 0 人点赞
#extraction

SafeLLM:在安全关键场景中,提取作为重写的抗幻觉替代方案

arXiv cs.CL · 2026-06-12 缓存

本文提出SafeLLM,一种基于提取的方法,用于从安全关键文档中检索信息,表明行号选择在减少幻觉的同时保持高召回率方面优于基于重写的RAG方法。

0 人收藏 0 人点赞
#extraction

@xin_pai88825: 之前做的一个 web to design md 的skill,一直忘记给大家分享,目前已开源到 github,图一图二是提取出来的效果,朋友都在夸。使用方式也很简单,直接发网址给他,让他帮你提取 design.mdj就行了

X AI KOLs Following · 2026-06-08 缓存

作者分享了一个将网页转换为 design.md 的开源工具,使用简单,只需发送网址即可提取设计文件。

0 人收藏 0 人点赞
#extraction

@jerryjliu0: 我们构建了一个很酷的项目,展示了如何将核心文档智能原语组合成可复用的流水线…

X AI KOLs Following · 2026-06-04 缓存

Parse-Flow 是一个开源的可视化工作流设计器,它将文档智能原语(解析、提取、分类、拆分)组合成可复用的流水线,底层基于 LlamaIndex 和 Python 工作节点。

0 人收藏 0 人点赞
#extraction

AI搜索奖励那些能够经受提取的源内容

Reddit r/AI_Agents · 2026-05-26

AI搜索引擎从页面中提取并改写内容,优先选择可引用、有证据支持的材料,而非通用摘要。内容创作者应专注于为引用而写作,而不仅仅是点击量。

0 人收藏 0 人点赞
#extraction

@DanKornas: 你的文本语料库不应该被局限在段落中。kg-gen 是一个用于从…提取知识图谱的 Python 包。

X AI KOLs Timeline · 2026-05-21 缓存

kg-gen 是一个开源 Python 包,通过语言模型(借助 LiteLLM 和 DSPy)从纯文本或对话消息中提取知识图谱,具备分块、聚类和灵活的路由提供商功能。

0 人收藏 0 人点赞
#extraction

@Huanusa: 前端+设计师真的要失业了! 有人做了个神器 http://designmd.me: 直接扔网站URL进去,一键提取完整设计系统 (配色、字体、组件、布局全扒出来),自动生成 DESIGN.md 文件! 直接扔网站 URL 进去, 一键提取…

X AI KOLs Timeline · 2026-05-16 缓存

有人开发了一个神器 designmd.me,只需输入网站 URL 即可一键提取完整的设计系统(配色、字体、组件、布局),自动生成 DESIGN.md 文件。配合已有 5.4 万星的 awesome-design-md 仓库,能快速复刻顶级品牌的 UI。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈