clinical-ai

标签

Cards List
#clinical-ai

LLMs 是否已准备好协助医生?PhysAssistBench:用于交互式医生-患者-EHR 辅助的基准

arXiv cs.CL ↗ · 2026-06-18 缓存

介绍了 PhysAssistBench,这是一个用于评估 LLM 在交互式医生-患者-EHR 辅助中性能的基准。实验表明,当前模型在此场景下不可靠,凸显了协调能力的需求。

0 人收藏 0 人点赞
#clinical-ai

新研究展示了我们的医疗AI——AMIE如何帮助管理健康状况。

Google AI Blog ↗ · 2026-06-17 缓存

Google的研究表明,其医疗AI——AMIE能够长期有效管理健康状况,在推理能力上与临床医生相当,在计划的精确性和与指南的一致性方面更胜一筹,据发表在Nature上的一项研究所示。

0 人收藏 0 人点赞
#clinical-ai

基于AI心理健康对话的被动抑郁严重程度评估的LLMs微调

arXiv cs.CL ↗ · 2026-06-17 缓存

本文提出一种对LLMs进行微调的方法,用于从AI心理健康应用的对话记录中直接预测PHQ-9抑郁严重程度评分,通过包含6,283名用户的增强数据集,实现了与临床阈值的强相关性。

0 人收藏 0 人点赞
#clinical-ai

医院中的AI并非替代医生,而是优化医院实际运作方式

Reddit r/AI_Agents ↗ · 2026-06-15

医院中的AI旨在改善操作流程并支持临床决策,而非替代医生,重点是将AI融入现有系统,用于分诊、化验结果审查和患者监测等任务。

0 人收藏 0 人点赞
#clinical-ai

LongMoE:基于轨迹感知的混合专家模型的纵向多模态学习

arXiv cs.LG ↗ · 2026-06-10 缓存

LongMoE提出了一个统一框架,同时解决多模态临床学习中的模态缺失和纵向动态问题,利用上下文感知插补、注意力令牌化、轨迹感知编码和稀疏混合专家路由。在ADNI、OASIS-3和MIMIC-IV上的实验表明,在缺失模态情况下鲁棒性得到提升,同时在完整模态设置下仍具有竞争力。

0 人收藏 0 人点赞
#clinical-ai

AI系统通过寻找严重男性不育症病例中罕见的可存活精子细胞,帮助实现首次临床妊娠

Reddit r/artificial ↗ · 2026-06-04

一个AI辅助的微流控系统成功在严重男性不育症病例中仅识别出两个可存活的精子细胞,从而通过该技术实现了首次临床妊娠。虽然基于单一病例报告,但这代表了AI辅助生殖医学的一个重要里程碑。

0 人收藏 0 人点赞
#clinical-ai

反事实评估揭示临床大语言模型和智能体的隐藏能力画像

arXiv cs.LG ↗ · 2026-06-01 缓存

本文介绍了因果敏感性得分(CSS),一种干预性指标,用于评估临床大语言模型和智能体在患者输入沿临床意义维度变化时,是否适当地更新其建议。该指标揭示了标准覆盖度指标未能捕捉的隐藏能力画像,暴露了安全盲点和结构性响应能力缺陷。

0 人收藏 0 人点赞
#clinical-ai

按部就班:使用评分规则的自动睡眠分期分类

arXiv cs.AI ↗ · 2026-05-25 缓存

本文提出了一种确定性的、基于规则的睡眠分期方法,该方法明确实现了美国睡眠医学学会(AASM)的评分规则,并提供了逐时段的自然语言解释。在50份多导睡眠图记录中,该方法与多数投票共识达到了60.5%的逐时段一致性,为不透明的深度学习模型提供了透明性的补充。

0 人收藏 0 人点赞
#clinical-ai

@MaziyarPanahi:开源临床AI是一个小众领域,大多数时候感觉就像对着一个PubMed形状的虚空呐喊。然而,你们中的5000人……

X AI KOLs Following ↗ · 2026-05-22 缓存

一位开发者感谢5000名关注者支持开源临床AI项目OpenMed,并暗示即将发布新的模型和数据集。

0 人收藏 0 人点赞
#clinical-ai

GraphDiffMed: 知识约束的差异化注意力结合药理学图先验用于药物推荐

arXiv cs.LG ↗ · 2026-05-21 缓存

GraphDiffMed是一个药物推荐框架,它使用双尺度差异化注意力和药理学图先验来提高在EHR数据上的推荐质量和安全性。在MIMIC-III上的实验显示出相对于基线的持续改进。

0 人收藏 0 人点赞
#clinical-ai

提示语言影响大型语言模型的诊断推理和准确性

arXiv cs.CL ↗ · 2026-05-20 缓存

本研究评估了提示语言(英语与法语)如何影响五个大型语言模型的诊断推理和准确性,使用了180个临床案例,发现大多数模型在英语下表现显著更好,只有o3是例外。

0 人收藏 0 人点赞
#clinical-ai

MuteBench:不完整多模态融合中的模态不可用容忍度评估

arXiv cs.LG ↗ · 2026-05-18 缓存

MuteBench是一个基准测试,用于评估多模态融合模型在临床数据集上的模态缺失和模态内部缺失条件下的性能。它提供了关于架构鲁棒性的见解,并表明基于扩散的插补方法可以有所帮助。

0 人收藏 0 人点赞
#clinical-ai

通过稀疏自编码器实现脑电图基础模型的机制可解释性

arXiv cs.LG ↗ · 2026-05-15 缓存

本文对三个脑电图基础模型(SleepFM、REVE、LaBraM)应用TopK稀疏自编码器,提取可解释的特征字典,并引入了概念引导框架,揭示了表征失败和临床纠缠问题。

0 人收藏 0 人点赞
#clinical-ai

RealICU:大型语言模型代理是否能理解长上下文ICU数据?一个超越行为模仿的基准测试

arXiv cs.AI ↗ · 2026-05-14 缓存

RealICU是一个事后标注的基准测试,用于评估ICU场景中的大型语言模型(LLM),涵盖四个由医生驱动的任务。实验表明,现有LLM在回忆-安全权衡和锚定偏差方面存在困难,而一种新的结构化记忆代理改善了推理能力,但未能完全消除安全故障。

0 人收藏 0 人点赞
#clinical-ai

ASD-Bench:用于自闭症谱系障碍的 AI 模型四维综合基准测试

arXiv cs.LG ↗ · 2026-05-13 缓存

本文介绍了 ASD-Bench,这是一个全面的基准测试,从预测性能、校准度、可解释性和鲁棒性四个维度评估用于自闭症谱系障碍(ASD)筛查的 AI 模型。该研究使用 AQ-10 数据分析了不同年龄组的多种模型,强调了在临床 AI 应用中采用多指标评估的重要性。

0 人收藏 0 人点赞
#clinical-ai

从词元到词元对:临床预测中大语言模型的提示高效压缩

arXiv cs.CL ↗ · 2026-05-13 缓存

本文介绍了 MedTPE,一种针对大语言模型电子健康记录的高效无损提示压缩方法,可显著降低临床预测任务中的词元长度和推理延迟。

0 人收藏 0 人点赞
#clinical-ai

MedQA:在AMD ROCm上微调临床AI——无需CUDA

Hugging Face Blog ↗ · 2026-05-08 缓存

一个教程和项目,演示在AMD MI300X上使用ROCm对Qwen3-1.7B进行LoRA微调,用于临床问答,为医疗AI开发提供无需CUDA的替代方案。

0 人收藏 0 人点赞
#clinical-ai

DeepER-Med:通过智能体AI推进医学深度循证研究

arXiv cs.AI ↗ · 2026-04-20 缓存

DeepER-Med引入了一个用于循证医学研究的智能体AI框架,具有明确的证据评价标准和新的基准数据集(DeepER-MedQA),包含100个专家精选的医学问题,相比生产平台表现更优,并通过真实案例的临床验证。

0 人收藏 0 人点赞
#clinical-ai

WiseMind:一个知识引导的多智能体框架,用于准确且富有同理心的精神疾病诊断

arXiv cs.CL ↗ · 2026-04-20 缓存

WiseMind是一个知识引导的多智能体框架,利用大语言模型进行精神疾病诊断,通过结合用于循证逻辑的“理性思维”智能体和用于共情沟通的“情感思维”智能体,在模拟和真实患者交互中实现了85.6%的诊断准确率。该框架利用DSM-5结构化知识图谱减少幻觉,并在保持临床合理性和心理支持的同时,比单智能体基线高出15-54个百分点。

0 人收藏 0 人点赞
#clinical-ai

医疗健康

OpenAI Blog ↗ · 2026-04-10 缓存

OpenAI Academy 发布了医疗健康用例指南,包含适用于临床工作流程的提示模板,涵盖诊断测试、鉴别诊断、护理计划和患者文档。旨在帮助医疗专业人员利用AI进行临床决策。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈