标签
介绍ContextGuard,一个结构化自我审计框架,通过将模型自我评估分解为确认和不确定类别并应用针对性修订来改进语言模型上下文学习。在CL-Bench基准测试中,Qwen3.5-4B的任务解决率从9.64%提升至13.85%。