legal-nlp

标签

Cards List
#legal-nlp

LegalPincite:多层级法律信息检索数据集

Hugging Face Daily Papers · 5天前 缓存

介绍LegalPincite,一个基于欧盟法院(CJEU)判决构建的大规模法律信息检索数据集,包含掩码查询、完整语料库和段落级引文标注,以支持多层级检索评估。

0 人收藏 0 人点赞
#legal-nlp

欺骗语义:法律领域欺骗检测与通用领域最先进方法的基准测试

arXiv cs.CL · 6天前 缓存

本文综述并评测了法律语境下基于NLP的自动欺骗检测,比较了微调Transformer和七个大语言模型(LLM)在七个数据集上采用多种提示策略的表现。结果表明存在明显的领域敏感性:微调模型在数据丰富的通用领域表现出色,而少样本LLM在低资源法律场景中具有竞争力。

0 人收藏 0 人点赞
#legal-nlp

BLAD:孟加拉国法律法案的历史语境化多语种数据集(1799-2025)

arXiv cs.CL · 2026-07-21 缓存

本文介绍了BLAD,一个精心整理的多语种数据集,包含1484部孟加拉国法律法案(时间跨度从1799年到2025年),并附有结构化元数据,支持时间跨度和跨语言的法学NLP研究。

0 人收藏 0 人点赞
#legal-nlp

DECODEM: 通过增强方法从公司组织文档中提取数据

arXiv cs.CL · 2026-07-20 缓存

介绍DECODEM,这是一个基准数据集,用于评估使用大型语言模型从法律文档中自动提取公司治理变量的方法,结果显示对许多条款具有高准确性。

0 人收藏 0 人点赞
#legal-nlp

当推理损害法律文书撰写:专利权利要求生成中的语言化瓶颈

arXiv cs.CL · 2026-07-14 缓存

本文研究了思维链(CoT)提示是否有利于专利权利要求生成,发现隐式CoT(推理内部进行)始终优于显式CoT,而显式CoT会引入一个语言化瓶颈,通过抽象化细节、破坏模式及错误传播来损害输出质量。

0 人收藏 0 人点赞
#legal-nlp

PRecG: 基于图神经网络与修辞角色分割的法律先例检索

arXiv cs.CL · 2026-07-13 缓存

PRecG 提出了一种新颖的法律先例检索流程,通过将文档分解为修辞段落,为每个段落构建知识图谱,并利用图神经网络学习层次化表示。在印度法律数据上的实验证明了其相对于基线方法的有效性。

0 人收藏 0 人点赞
#legal-nlp

从判决到争议点:带有引用幻觉控制的法律推理的结构化提取

arXiv cs.CL · 2026-07-07 缓存

本文介绍了一条自动化流水线,该流水线使用 DeepSeek V3 模型将意大利税务法院判决分解为各个法律争议点,并按照 IRAC 框架以 XML 格式结构化表示,同时包含一个使用 Linkoln 解析器验证引用的幻觉检测过滤器,该过滤器已由专家注释者验证。

0 人收藏 0 人点赞
#legal-nlp

基于思维树启发的混合方法:使用大语言模型进行法律案件判决摘要生成

arXiv cs.CL · 2026-06-29 缓存

提出一种基于思维树的抽取-生成混合方法,利用大语言模型进行法律案件判决摘要,在DeepSeek和LLama上的实验表明,该方法生成的摘要优于单独的抽取式或生成式方法。

0 人收藏 0 人点赞
#legal-nlp

LAUKIN:一个跨司法管辖区的普通法合同数据集

arXiv cs.CL · 2026-06-12 缓存

介绍了LAUKIN,一个包含来自澳大利亚、英国和印度合同的条款对数据集,标注了法律等价性。评估了12个模型,宏平均F1分数达到65.11%,建立了一个具有挑战性的基准。

0 人收藏 0 人点赞
#legal-nlp

HKJudge:一个用于解读法院认定、推理和裁决的法律话语标注语料库

arXiv cs.CL · 2026-06-08 缓存

HKJudge是首个针对香港刑事判决进行句子级专家标注的法律话语语料库,包含两层话语标注体系以及基于BERT和LLM模型的基准评估。

0 人收藏 0 人点赞
#legal-nlp

EURO-5K:领域预训练何时重要?面向欧盟报告义务抽取的Transformer基准测试

arXiv cs.CL · 2026-06-03 缓存

本文介绍了EURO-5K,一个用于从欧盟立法中提取报告义务的句子级数据集,并在全微调和参数高效QLoRA下对判别式和生成式Transformer模型进行了基准测试。结果表明,法律预训练主要惠及适应能力有限的模型,且所有方法在大约3000个样本时趋于收敛。

0 人收藏 0 人点赞
#legal-nlp

结合KAN模块增强BiGRU的法律文档分类与摘要生成

arXiv cs.CL · 2026-06-02 缓存

本文提出一种KAN增强的BiGRU架构,用于对孟加拉国的多语言法律文档进行分类和摘要生成,取得了适中的准确率和ROUGE分数,并证明KAN模块相比基线BiGRU提升了分类准确率。

0 人收藏 0 人点赞
#legal-nlp

UA-Legal-Bench:评估大语言模型在乌克兰法律推理能力的基准

arXiv cs.CL · 2026-05-29 缓存

介绍了UA-Legal-Bench,这是一个基于统一国家法院判决登记册构建的、用于评估大语言模型在乌克兰法律推理能力的五项任务基准。评估了11个LLM,揭示了任务相关的少样本效应以及在不平衡法律任务中准确率的误导性。

0 人收藏 0 人点赞
#legal-nlp

通过检索、聚类和生成从案例数据库生成法律评注

arXiv cs.CL · 2026-05-26 缓存

本文提出了一种完全自动化的流程,通过提取、聚类和总结段落级块(使用LLM),将法院判决转化为法律评注,并在德国民法典案例上进行了评估。

0 人收藏 0 人点赞
#legal-nlp

法律判决预测中的时间概念漂移:基于乌克兰法院判决三个时期的神经基线

arXiv cs.CL · 2026-05-26 缓存

本文通过在地缘政治动荡定义的三个时期的乌克兰法院判决上微调Transformer模型,研究法律判决预测中的时间概念漂移。发现显示严重的前向退化、反向迁移的不对称性,以及按时间顺序的持续学习有效缓解遗忘,而领域预训练降低退化幅度。

0 人收藏 0 人点赞
#legal-nlp

LP-Eval: 用于衡量法律命题生成质量的评分标准与数据集

arXiv cs.CL · 2026-05-20 缓存

本文介绍了LP-Eval,这是一个由法律专家标注的、用于评估大语言模型生成法律命题质量的评分标准与数据集。结果表明,基于评分标准的LLM评估比直接打分更接近专家评估。

0 人收藏 0 人点赞
#legal-nlp

IMLJD:用于印度婚姻诉讼分析的计算数据集

arXiv cs.CL · 2026-05-20 缓存

本文介绍了IMLJD,一个专门用于分析印度婚姻诉讼的计算数据集,支持自然语言处理和法律分析研究。

0 人收藏 0 人点赞
#legal-nlp

从一亿乌克兰法院判决自动构建法律引用图:大规模提取、拓扑分析与本体驱动聚类

arXiv cs.CL · 2026-05-18 缓存

本文从1.007亿份乌克兰法院判决中构建了首个大规模引用图,提取了超过5亿条引用链接。研究表明,引用结构能够自动恢复法律领域边界,并以接近完美的准确度预测立法重要性。此外,本文将处理流程和数据作为开放资源发布。

0 人收藏 0 人点赞
#legal-nlp

一些好条款:比较LLMs与领域训练的小型语言模型在结构化合同提取中的表现

arXiv cs.CL · 2026-05-08 缓存

本文比较了领域训练的小型语言模型(Olava Extract)与前沿LLMs在结构化合同提取中的表现,结果显示该专业化模型获得了更高的F1分数且成本显著降低。

1 人收藏 1 人点赞
← 返回首页

提交意见反馈