大型语言模型时代的圣训计算科学:批判性叙事综述

Hugging Face Daily Papers 论文

摘要

本文批判性地评述了大型语言模型时代的圣训计算科学,重点分析了该领域的进展、方法论上的不足,并提出一项研究议程以加强伊斯兰学术的证据基础设施。

我们审视了Transformer模型、检索增强流程以及大型语言模型如何重塑圣训计算科学。近期的文献综述记录了该领域的增长,但尚未对哪些进展在方法论上是稳健的、哪些仍受限于基准测试、以及哪些未解决的问题仍阻碍其学术应用,提供批判性评述。我们通过一项批判性叙事综述来填补这一空白,该综述结合了对现有综述的批判、对代表性原始研究的论文级评估,以及综合了伊斯兰学者和领域专家关于真实性、权威性和负责任使用的观点。我们发现该领域的进展不均衡。数据资源已扩展,分割任务趋于成熟,传述人和来源验证问题得到了更好的形式化,而基于LLM的工作流现已支持语料库级别的丰富化、多语言访问以及基于依据的评估。与此同时,进展仍受到限制,原因包括:狭窄的语料库、薄弱的基准可比性、从合成数据到真实数据的迁移鸿沟、传述人身份解析困难、预处理的脆弱性、有限的可复现性以及稀缺的基于专家的验证。我们指出,重要的差距存在于主流基准之外:非正典和冷僻的语料库、注释和解释性文献、与《古兰经》和先知传记的跨来源关联,以及面向教法证据的支持。我们主张,对圣训计算的评估应较少作为孤立的模型性能问题,而更多视为一个需要知识整合、来源追溯和专家监督的证据基础设施问题。基于此,我们为使该领域方法论更强大、对伊斯兰学术更有用,定义了一项研究议程。
查看原文
查看缓存全文

缓存时间: 2026/08/24 04:39

论文页面 - 大型语言模型时代的圣训计算科学:批判性叙事综述

来源:https://huggingface.co/papers/2608.20364

摘要

圣训计算科学被视为一项需要整合Transformer与检索方法、并借助专家验证和溯源机制的证据基础设施挑战。

本文审视圣训计算科学如何被Transformer模型 (https://huggingface.co/papers?q=transformer%20models)、检索增强流程 (https://huggingface.co/papers?q=retrieval-grounded%20pipelines) 以及大型语言模型 (https://huggingface.co/papers?q=large%20language%20models) (LLMs) 所重塑。近期的综述文献记录了该领域的增长,但尚未批判性地厘清哪些进展在方法论上是坚实的、哪些仍受限于基准测试、以及哪些未解决的问题仍在限制其学术应用。我们通过一项批判性叙事综述来填补这一空白,该综述结合了对现有综述的批判、对代表性原创研究的论文级评估,并综合了伊斯兰学者与领域专家关于真实性、权威性和负责任使用的观点。我们发现进展并不均衡:数据资源有所扩展,分割任务趋于成熟,传述人与来源验证问题得到了更好的形式化,而LLM辅助的工作流现已能支持语料库规模的增强、多语言访问和基于溯源的评估。与此同时,进展仍受限于狭窄的语料库、薄弱的基准可比性、合成数据到真实数据的迁移 (https://huggingface.co/papers?q=synthetic-to-real%20transfer) 鸿沟、传述人身份解析、预处理脆弱性、有限的可重复性以及稀疏的专家验证。我们表明,重要的差距存在于主流基准测试之外:非正典和冷门语料库、注释与解释性文献、与《古兰经》和先知传记的跨来源关联,以及面向教法(Fiqh)的证据支持。我们认为,圣训计算的评估不应孤立地看待模型性能,而应将其视为一个需要知识整合、溯源和专家监督的证据基础设施问题。基于此,我们定义了一项研究议程,旨在使该领域在方法论上更强健,并对伊斯兰学术更有用。

查看 arXiv 页面 (https://arxiv.org/abs/2608.20364) 查看 PDF (https://arxiv.org/pdf/2608.20364) 项目页面 (https://minstar.github.io/AgentMercury/) 添加到收藏集 (https://huggingface.co/login?next=%2Fpapers%2F2608.20364)

在您的智能体中获取此论文:

hf papers read 2608\.20364

没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用此论文的模型0

没有模型链接此论文

在模型的 README.md 中引用 arxiv.org/abs/2608.20364 以从本页链接它。

引用此论文的数据集0

没有数据集链接此论文

在数据集的 README.md 中引用 arxiv.org/abs/2608.20364 以从本页链接它。

引用此论文的 Spaces0

没有 Space 链接此论文

在 Space 的 README.md 中引用 arxiv.org/abs/2608.20364 以从本页链接它。

包含此论文的收藏集0

没有收藏集包含此论文

将此论文添加到收藏集 (https://huggingface.co/new-collection) 以从本页链接它。

相似文章

大语言模型时代的Hadith计算科学:批判性叙述综述

arXiv cs.CL

本批判性叙述综述探讨了大语言模型和基于transformer的系统如何重塑Hadith计算科学,突出了数据资源和分段任务方面的进展,同时指出了叙述者验证和可重复性方面的差距,并提出了方法论强化的研究议程。

科学概念的计算概念史:从早期数字方法到大语言模型

arXiv cs.CL

本文将大语言模型置于科学史、科学哲学与科学社会学(HPSS)领域概念分析计算方法的宏观历史背景之中,系统回顾了词汇语义变化检测的方法论挑战与基于大语言模型的案例研究,涵盖前大语言模型时代与大语言模型时代工作流程中的语料库构建、操作化及评估方法。

大语言模型在低资源语言人文学科研究中的机遇与挑战

arXiv cs.CL

本文系统评估了大语言模型在低资源语言研究中的应用,分析了在语言变异、历史文献、文化表达和文学分析等方面的机遇与挑战。研究强调了跨学科合作和定制化模型开发,以保护语言和文化遗产,同时解决数据可获取性、模型适应性和文化敏感性问题。