Canvas原生评分标准生成器(符合QM标准并培训用户)
摘要
一款工具,可为任何主题生成符合QM标准的评分标准,在过程中培训用户,并生成CSV文件,便于上传至Canvas原生评分环境。
分享这个工具,何乐而不为呢?这是我之前为所在大学的教职员工开发的工具。该工具可以接受任何主题(例如“体育”)或目标(如“学生将学习……体育”)……或任何版本的优质评分标准,然后它会不断提问,直到你得到一个可衡量的、符合Quality Matters标准的评分标准。最棒的是,之后它会生成一个CSV文件,并告诉你如何将其上传到Canvas,以便在Canvas原生环境中使用,例如将评分标准附加到作业上,或在SpeedGrader中评分等。
相似文章
以评分标准作为视觉修复上下文的自演化UI到代码生成
RubSE是一个框架,它利用评分标准引导的自演化,通过缓解视觉修复耦合和轨迹崩溃来增强UI到代码生成的稳定性。
RubricsTree:跨健康记忆与医疗技能的个人健康智能体可扩展且不断演进的开放式评估
RubricsTree 提出了一种可扩展且与专家对齐的个人健康智能体评估框架,使用超过100个原子布尔规则,在Gemini、GPT和Qwen模型系列的HealthBench上实现了高达66%的相对提升。
C2:基于二元偏好的可扩展评分增强奖励建模
C2 提出了一种可扩展的评分增强奖励建模框架,该框架仅通过二元偏好训练一个协作的评分生成器和一个批判性验证器,无需昂贵的评分标注,同时在 RM-Bench 上实现了最高 6.5 分的提升。
自动评分标准作为奖励:从隐性偏好到显式多模态生成准则
本文介绍了自动评分标准作为奖励(ARR)框架,该框架将隐性偏好知识外显化为多模态对齐的显式评分标准。文章提出了评分标准策略优化(RPO)以稳定策略梯度,在文生图和图像编辑任务中取得了更佳的性能。
基于预训练文本的自评规则自博弈,为开放式任务自举后训练信号
康奈尔研究者提出 POP 自博弈框架,让大模型自行生成评分规则与训练样本,在医疗问答、创意写作、指令遵循等开放式任务上提升 Qwen-2.5-7B,无需人工标注。