GLiNER2: 一个高效的多任务信息提取系统 具有模式驱动接口
摘要
GLiNER2 是一个基于Transformer的统一框架,用于多种NLP任务,通过支持命名实体识别、文本分类和层次数据提取,在单个模型中提供比大型语言模型更高的效率和可访问性。
查看缓存全文
缓存时间: 2026/09/19 14:54
论文页面 - GLiNER2:基于模式驱动接口的高效多任务信息抽取系统
来源:https://huggingface.co/papers/2507.18546 发布于 2025年7月24日
摘要
GLiNER2 是一个统一的、基于Transformer架构的框架,支持多种自然语言处理任务,相比大型语言模型具有更高的效率和易用性。
信息抽取是众多自然语言处理应用的基础,但现有解决方案往往需要针对不同任务使用专用模型,或依赖计算成本高昂的大型语言模型。我们推出了GLiNER2,这是一个统一框架,它在原版GLiNER架构的基础上进行了增强,可在单个高效模型内同时支持命名实体识别、文本分类和层次结构化数据抽取。基于预训练Transformer编码器架构构建的GLiNER2,在保持CPU运行效率和紧凑模型规模的同时,通过直观的基于模式的接口引入了多任务组合能力。我们的实验表明,在抽取和分类任务上,该模型性能具有竞争力,并且相比基于LLM的替代方案,在部署易用性方面有显著提升。我们将GLiNER2作为开源pip可安装库发布,包含预训练模型和文档,详见 https://github.com/fastino-ai/GLiNER2。
查看arXiv页面 (https://arxiv.org/abs/2507.18546) 查看PDF (https://arxiv.org/pdf/2507.18546) GitHub 1.99k (https://github.com/fastino-ai/GLiNER2) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2507.18546)
社区
论文提交者
2025年7月25日 (https://huggingface.co/papers/2507.18546#6883373caa5807bb1c99950c)
太酷了,这工作真的非常棒,伙计们!
论文作者
2025年7月25日 (https://huggingface.co/papers/2507.18546#688378a6ed2a752560042663)
你好,很棒的工作!
我想知道你们何时会发布模型,谢谢!
请告知我们模型是否会开源。
·
请支持多语言,你们太棒了
很棒的工作!GitHub仓库何时能用?是否有预训练模型已经发布了?
我能获取模型权重吗?
通过拖入文本框、粘贴或点击此处上传图片、音频和视频。
点击或粘贴在此处上传图片
通过智能体获取此论文:
hf papers read 2507.18546
没有最新版CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 14个
fastino/gliner2.5-multi-v1 令牌分类• 0.3B• 3天前更新 • 200k • 212 (https://huggingface.co/fastino/gliner2.5-multi-v1)
fastino/gliner2-base-v1 0.2B• 3天前更新 • 401k • 99 (https://huggingface.co/fastino/gliner2-base-v1)
fastino/gliner2-large-v1 0.5B• 3天前更新 • 226k • 97 (https://huggingface.co/fastino/gliner2-large-v1)
fastino/gliner2-multi-v1 0.3B• 3天前更新 • 201k • 87 (https://huggingface.co/fastino/gliner2-multi-v1)
浏览引用此论文的14个模型 (https://huggingface.co/models?other=arxiv:2507.18546)## 引用此论文的数据集 0个
没有链接此论文的数据集
在数据集的README.md中引用 arxiv.org/abs/2507.18546 以从此页面链接它。
引用此论文的空间 27个
浏览引用此论文的27个空间 (https://huggingface.co/spaces?arxivIds=2507.18546)## 包含此论文的合集 1个
相似文章
GLiNER-Relex:联合命名实体识别与关系提取的统一框架
GLiNER-Relex 是一个用于联合命名实体识别(NER)与关系提取(RE)的统一框架,利用共享的 Transformer 编码器实现零样本能力。该论文展示了模型在标准基准测试中具有竞争力的性能,并将其作为开源 Python 包发布。
@george_onx: 最近看到很多将Jev与GLiNER模型进行比较的情况。如果你正在进行基准测试,GLiNER2.5是我们发布的最新版本…
GLiNER2.5 是一个多语言边界检查点,用于统一的基于模式的信息提取,支持实体、分类、结构化记录、关系和跨度属性在一个模型中。
通过大型语言模型增强科学命名实体识别:一种类型驱动的多任务学习方法
本文提出TdSciNER,一种类型驱动的多任务学习方法,利用LLMs通过过滤实体类型、添加辅助类型分类任务和使用示范选择策略来改进科学命名实体识别。在三个数据集上的实验表明,其性能可与全监督模型相媲美。
fastino/GLiNER2.5-Decide
GLiNER2.5-Decide 是一个拥有340M参数的英文分类模型,专为操作决策设计,能在单次前向传播中支持多个标签集,无需使用提示模板。
SchemaRAG: 面向LLM驱动的结构化信息提取的动态大规模模式简化
SchemaRAG是一个检索增强生成框架,能够动态缩减面向LLM驱动的结构化信息提取的输出模式空间,在医疗健康和电子商务数据集上实现了性能提升和效率优化。