标签
介绍CANDI-QA,这是一个用于评估大语言模型在小众领域上下文对齐能力的数据集,包含信息辅助型和应用推理型问题。对十多个大语言模型的系统评估揭示了挑战,并提出了一个轻量级神经符号框架MTSS-Net作为基线。