clinical-reasoning

标签

Cards List
#clinical-reasoning

Cura 1T:面向智能体医疗的专用模型

arXiv cs.AI · 昨天 缓存

Cura 1T 是一款专注于医疗领域的LLM,通过人工门控的自我进化循环进行训练,该循环在患者咨询、临床推理和智能体医疗任务上不断改进,在医学基准测试中取得了顶尖性能,同时保持了通用推理能力。

0 人收藏 0 人点赞
#clinical-reasoning

大语言模型在代理式临床推理中的信息寻求失败

arXiv cs.AI · 2026-07-14 缓存

本文为血液肿瘤学中的临床推理开发了一个代理式评估框架,发现大语言模型的主要失败原因在于系统性的信息寻求缺陷,而非知识不足,其错误模式类似于新手临床医生的认知偏差。

0 人收藏 0 人点赞
#clinical-reasoning

评估检索增强生成与长上下文输入在电子健康记录临床推理中的比较

arXiv cs.CL · 2026-07-13 缓存

本文评估了检索增强生成(RAG)与长上下文提示在电子健康记录临床推理任务中的表现,发现RAG在令牌效率上具有竞争力,尤其在影像提取和抗生素时间线重建方面表现突出。

0 人收藏 0 人点赞
#clinical-reasoning

迈向肝细胞癌精准治疗:用于风险分层和治疗指导的临床推理大语言模型

arXiv cs.AI · 2026-07-10 缓存

本文介绍HCC-STAR,一个临床对齐的大语言模型,用于肝细胞癌的风险分层和治疗指导,旨在通过利用电子病历改进精准治疗。

0 人收藏 0 人点赞
#clinical-reasoning

面向安全的假设演绎框架用于AI辅助鉴别诊断

arXiv cs.AI · 2026-07-10 缓存

AegisDx是一个面向安全的框架,它利用专门的LLM组件和验证门进行假设演绎临床推理,在医学病例报告上,将鉴别诊断准确率比单独的LLM提高了7-17个百分点。

0 人收藏 0 人点赞
#clinical-reasoning

CLExEval:一种用于定性评估LLM临床推理的人机交互框架

arXiv cs.CL · 2026-07-01 缓存

CLExEval 引入了一种人机交互框架,用于在渐进信息遮蔽条件下评估 LLM 临床推理,揭示了 GPT-4o-mini 和 HuatuoGPT-o1 等模型中存在的失败模式,如冗长偏见、隐藏知识悖论以及推理与输出不匹配。

0 人收藏 0 人点赞
#clinical-reasoning

打破故障级联:面向医学多模态推理的步骤感知强化学习

Hugging Face Daily Papers · 2026-06-30 缓存

介绍MRPO,一种利用步骤过程奖励来减轻临床多模态推理中级联错误的强化学习算法,在医学VQA基准上优于现有方法。

0 人收藏 0 人点赞
#clinical-reasoning

经验造就技能:通过自我演进的技能记忆实现可泛化的医学智能体推理

Hugging Face Daily Papers · 2026-06-08 缓存

本文介绍了SkeMex,一个自我演进的框架,通过将交互轨迹提炼为结构化技能记忆来增强医学智能体,并利用上下文相关的效用估计与治理实现更好的长期临床推理。

0 人收藏 0 人点赞
#clinical-reasoning

ChatHealthAI: 将电子健康记录表示与大型语言模型对齐以实现基于临床的推理

arXiv cs.AI · 2026-06-03 缓存

ChatHealthAI 是一个多模态推理框架,它将结构化 EHR 表示与冻结的 LLM 对齐,从而在保持预测性能的同时实现基于临床的推理。

0 人收藏 0 人点赞
#clinical-reasoning

MedGuideX:将可执行指南中的决策逻辑内化至大型语言模型用于临床推理

arXiv cs.AI · 2026-05-27 缓存

MedGuideX 将临床实践指南转化为可执行的决策逻辑,以生成事实性和反事实性的问答数据用于训练医学大语言模型,在临床推理基准测试中实现了平均准确率相对提升 10.28%。

0 人收藏 0 人点赞
#clinical-reasoning

SEMA-RAG:一种用于医学推理的自进化多智能体检索增强生成框架

arXiv cs.CL · 2026-05-19 缓存

SEMA-RAG是一种自进化多智能体RAG框架,用于医学问答,它将解读、探索和裁决解耦为三个专业智能体,在多个基准测试中相较于基线取得了显著的准确率提升。

0 人收藏 0 人点赞
#clinical-reasoning

ClinSeekAgent:自动化多模态证据寻求以实现智能体临床推理

Hugging Face Daily Papers · 2026-05-19 缓存

ClinSeekAgent是一个自动化智能体框架,使大语言模型能够主动从原始数据源获取和综合多模态临床证据,提高纯文本和多模态任务中的决策准确性。它引入了ClinSeek-Bench基准和一个蒸馏模型ClinSeek-35B-A3B,该模型在智能体临床推理上取得了强劲性能。

0 人收藏 0 人点赞
#clinical-reasoning

Checkup2Action:用于生成面向患者的行动卡片的临床体检报告多模态数据集

arXiv cs.CL · 2026-05-13 缓存

本文介绍了Checkup2Action,这是一个用于从临床体检报告生成面向患者的行动卡片的多模态数据集和基准测试,旨在解决普通患者理解医疗报告的困难。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈