diagnostic-reasoning

标签

Cards List
#diagnostic-reasoning

多轮多模态诊断推理在具有挑战性的真实临床案例上的评估

arXiv cs.CL · 2026-07-29 缓存

本文提出了一种利用具有挑战性的真实临床案例对多轮多模态诊断推理进行评估的方法,旨在衡量AI模型处理复杂医疗场景的能力。

0 人收藏 0 人点赞
#diagnostic-reasoning

强化学习用于大型语言模型的寻求证据诊断推理

arXiv cs.AI · 2026-07-07 缓存

本文提出了一种基于强化学习的框架,用于利用大型语言模型进行寻求证据的诊断推理。经过强化学习训练的7B模型在多语言临床咨询任务中优于更大的模型,表明专门的强化学习可以提炼高水平的临床推理。

0 人收藏 0 人点赞
#diagnostic-reasoning

提示语言影响大型语言模型的诊断推理和准确性

arXiv cs.CL · 2026-05-20 缓存

本研究评估了提示语言(英语与法语)如何影响五个大型语言模型的诊断推理和准确性,使用了180个临床案例,发现大多数模型在英语下表现显著更好,只有o3是例外。

0 人收藏 0 人点赞
#diagnostic-reasoning

实验还是结果?探测大语言模型中的科学可行性

arXiv cs.CL · 2026-04-22 缓存

UMBC 研究人员发现,大语言模型在判断科学主张是否可行时,依据结果数据比依据实验描述更准确;不完整的实验背景反而会降低准确率。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈