llm-scoring

标签

Cards List
#llm-scoring

人工评分还是AI评分:课堂观察中AI评分的比较评估

arXiv cs.CL ↗ · 2026-09-17 缓存

本研究评估了使用GPT-5对早期儿童课堂中师幼互动进行评分,与人类评分者进行比较,发现部分一致性,但在全面评估中存在局限性。

0 人收藏 0 人点赞
#llm-scoring

跨移民路线体验性互文性检测:超越法语叙事的表面相似性

arXiv cs.CL ↗ · 2026-08-03 缓存

本文介绍了体验性互文性检测,使用包括零样本LLM评分在内的无标注方法,以识别来自不同路线的法语移民叙事中共享的体验回声。

0 人收藏 0 人点赞
#llm-scoring

每天有数百篇论文上传到arXiv,但可能只有3篇与我的研究相关,所以我开发了一个开源工具来找到它们 [P]

Reddit r/MachineLearning ↗ · 2026-07-13

作者开发了Research Radar,一个开源工具,可自动获取arXiv论文,使用LLMs对摘要进行评分以匹配用户定义的研究兴趣,并生成包含深度阅读摘要的个性化每日摘要。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈