标签
介绍Inspect India Evals,一个用于在印度语言文化语境中评估大语言模型的开源框架,包含六项基准测试,涵盖多语言能力、偏见、安全性和文化知识。对五个模型的测试显示,Sarvam-M 24B和Gemma 2 27B表现领先。
本文介绍了Ex-ToxiCN-MM——首个中文有害迷因解释数据集,以及知识库C-HarmKB和归因分析框架RIKE,通过考虑文化背景和语义模糊性,提升有害迷因的可解释检测能力。