标签
本文介绍了一个基于布鲁姆分类学的框架,用于测量大型语言模型(LLM)中的教育控制能力——即在保持教学意图的同时调整认知需求的能力——并在使用Qwen3模型的编程任务上对其进行评估,揭示了模型在增加难度方面表现出色,但在降低难度方面存在困难。