我们一直在分析人们如何在法律与合规任务中使用LLM(GDPR、AI法案等)。

Reddit r/ArtificialInteligence 新闻

摘要

对LLM在法律与合规任务中使用的分析显示,模型常常生成自信但无法验证的引用,引发了对AI输出可靠法律依据的质疑。

有一个问题反复出现:模型常常给出非常自信的法律答案,但引用的来源要么缺失、要么过时,要么无法追溯到官方整合来源。即使引用了某些内容,也不总是清楚它是否反映法律的当前版本。我很好奇其他人实际中是如何处理的:每次都依赖人工验证?还是已经有团队找到了解决AI输出“可验证法律依据”问题的可靠方法?
查看原文

相似文章

使用LLMs

Reddit r/singularity

这篇文章反思了身边的人对LLMs如ChatGPT的有限使用和理解,引发了关于AI工具广泛采用的疑问。

LLMs 何时真正有效?评估 LLMs 作为数据质量标注器

arXiv cs.CL

本研究评估了 LLMs 在电子商务任务中作为数据质量标注器的表现,发现当需要背景知识时,它们优于基线方法,但对于具有强烈词汇信号的任务优势有限,同时展示了跨运行的高度一致性。