medical-ai

标签

Cards List
#medical-ai

MedExpMem:经验记忆适配于鉴别诊断

arXiv cs.LG · 2026-05-25 缓存

提出MedExpMem,一个经验记忆框架,使医学视觉语言模型能够从过往病例中积累和检索具有鉴别性的诊断经验,在放射学基准上将鉴别诊断准确率最多提升7.0%。

0 人收藏 0 人点赞
#medical-ai

@itsolelehmann:Marc Andreessen刚刚上了Rogan的节目,随口分享了大量AI干货,完整播客长达3小时20分钟,但我整理出…

X AI KOLs Following · 2026-05-22 缓存

Marc Andreessen在Joe Rogan播客中分享了17个关于AI的极具争议的观点,包括声称AGI已经到来,顶级模型超越人类专家,以及AI正在改变医学、心理治疗、编程和科学。

0 人收藏 0 人点赞
#medical-ai

提示语言影响大型语言模型的诊断推理和准确性

arXiv cs.CL · 2026-05-20 缓存

本研究评估了提示语言(英语与法语)如何影响五个大型语言模型的诊断推理和准确性,使用了180个临床案例,发现大多数模型在英语下表现显著更好,只有o3是例外。

0 人收藏 0 人点赞
#medical-ai

预测中期阿尔茨海默病进展:基于ADNI临床和生物标志物历史数据实现24个月CDR-SB变化的残差间隙感知变换器

arXiv cs.LG · 2026-05-19 缓存

本文提出了一种残差间隙感知变换器,将混合效应统计参考与基于变换器的残差学习相结合,利用ADNI临床和生物标志物历史数据预测24个月CDR-SB变化,在均方误差和相关性上均优于基线模型。

0 人收藏 0 人点赞
#medical-ai

ClinSeekAgent:自动化多模态证据寻求以实现智能体临床推理

Hugging Face Daily Papers · 2026-05-19 缓存

ClinSeekAgent是一个自动化智能体框架,使大语言模型能够主动从原始数据源获取和综合多模态临床证据,提高纯文本和多模态任务中的决策准确性。它引入了ClinSeek-Bench基准和一个蒸馏模型ClinSeek-35B-A3B,该模型在智能体临床推理上取得了强劲性能。

0 人收藏 0 人点赞
#medical-ai

完全开放的 Meditron:用于临床 LLM 的可审计管道

arXiv cs.AI · 2026-05-18 缓存

介绍了完全开放的 Meditron,这是首个用于构建临床 LLM 的完全开放管道,具有临床医生审核的训练语料库和可重现框架,在全开放医学专科模型中达到领先水平。

0 人收藏 0 人点赞
#medical-ai

发现对抗肝纤维化的老药新用

Google DeepMind Blog · 2026-05-16 缓存

DeepMind的Co-Scientist AI在实验室测试中帮助识别了两种重新利用的药物,可阻断肝纤维化,其中一种抗癌药物阻断了91%的损伤反应,优于人类专家的选择。

0 人收藏 0 人点赞
#medical-ai

人工智能辅助的胎心监护:用于信号重建、胎心率分析和变异评估的统一模型

arXiv cs.LG · 2026-05-15 缓存

本文提出了一种基于AI的胎心率监测模型,该模型能够重建信号、分析变异,并以高灵敏度和特异性检测减速/加速。

0 人收藏 0 人点赞
#medical-ai

DT-Transformer:一个在真实世界健康系统上进行疾病轨迹预测的基础模型

arXiv cs.LG · 2026-05-15 缓存

DT-Transformer是一个基础模型,在Mass General Brigham(MGB)健康系统的11家医院中,基于170万名患者的5710万条结构化EHR记录进行训练,在896个疾病类别的下一事件预测中展现出强大的区分能力。

0 人收藏 0 人点赞
#medical-ai

量化并缓解前沿大语言模型中的过早闭合

arXiv cs.CL · 2026-05-15 缓存

本文定义并衡量了前沿大语言模型中的过早闭合现象,发现即使正确选项被移除或需要澄清时,模型仍频繁给出自信的回答,凸显了医疗应用中的一个关键安全问题。

0 人收藏 0 人点赞
#medical-ai

安大略省医生使用的AI转录工具出现‘幻觉’和错误,审计员发现 | CBC News

Reddit r/artificial · 2026-05-13 缓存

安大略省审计长发现,医生使用的AI转录工具产生错误和幻觉,可能危及患者护理,并批评政府测试不足。

0 人收藏 0 人点赞
#medical-ai

Checkup2Action:用于生成面向患者的行动卡片的临床体检报告多模态数据集

arXiv cs.CL · 2026-05-13 缓存

本文介绍了Checkup2Action,这是一个用于从临床体检报告生成面向患者的行动卡片的多模态数据集和基准测试,旨在解决普通患者理解医疗报告的困难。

0 人收藏 0 人点赞
#medical-ai

ClinicalBench:对 MIMIC-IV 跨入院临床问答中基于断言感知的检索进行压力测试

arXiv cs.CL · 2026-05-13 缓存

本文介绍了 ClinicalBench 和 EpiKG 系统,评估了针对 MIMIC-IV 数据在多个人工智能大语言模型(LLM)上的临床问答中基于断言感知的检索能力。研究证明,在检索过程中处理否定和时态信息,相比标准基线能显著提升性能。

0 人收藏 0 人点赞
#medical-ai

AntAngelMed - 100a6b 医疗大模型

Reddit r/LocalLLaMA · 2026-05-13 缓存

AntAngelMed 是由浙江省卫生健康信息中心、阿里健康(Ant Healthcare)以及安贞儿医疗 AI(Anzhen'er Medical AI)联合开发并开源的全新 1000 亿参数医疗大模型。该模型采用高效的 MoE(混合专家)架构以实现高性能推理,并在 HealthBench 和 MedAIBench 基准测试中取得了领先排名。

1 人收藏 1 人点赞
#medical-ai

@TeksEdge:全球首个开源 100B 医疗大模型已发布。本地推理者现在可以在家中运行健康模型选项。安...

X AI KOLs Timeline · 2026-05-12

浙江省人民医院与蚂蚁集团发布了 AntAngelMed,这是一个拥有 100B 参数的开源医疗大模型,在 MedBench 上排名前列,并支持高效且高隐私保护的本地推理。

0 人收藏 0 人点赞
#medical-ai

MedAction:迈向主动式多轮临床诊断大语言模型

arXiv cs.CL · 2026-05-11 缓存

本文介绍了 MedAction 框架,该框架通过模拟迭代式的检查开具与假设更新,训练大语言模型(LLM)进行主动的多轮临床诊断。文章提出了一个新的数据集 MedAction-32K,并展示了开源模型在医学基准测试上的最先进水平(SOTA)性能。

0 人收藏 0 人点赞
#medical-ai

STDA-Net:基于频谱图的跨数据集睡眠分期领域适应

arXiv cs.LG · 2026-05-11 缓存

本文介绍了STDA-Net,一种利用2D频谱图和对抗学习进行跨数据集睡眠分期的领域适应框架。在公共数据集上,与现有的1D EEG基线方法相比,该方法显示出更高的准确性和稳定性。

0 人收藏 0 人点赞
#medical-ai

MedExAgent:在嘈杂的临床环境中训练大语言模型代理进行询问、检查与诊断

arXiv cs.CL · 2026-05-11 缓存

本文介绍了 MedExAgent,这是一个将临床诊断形式化为部分可观测马尔可夫决策过程(POMDP)以处理嘈杂和不完整信息的框架。该框架提出了一种结合监督微调与强化学习的两阶段训练流程,以提高医疗大语言模型的诊断准确性和成本效益。

0 人收藏 0 人点赞
#medical-ai

@FinanceYF5: 3/ 准确性提升 GPT-5.5 Instant 在事实准确性上有明显提升。 尤其是在医学、法律、金融等对准确性要求更高的领域。

X AI KOLs Following · 2026-05-10 缓存

Report claims that GPT-5.5 Instant shows significant improvements in factual accuracy, particularly in high-stakes fields like medicine, law, and finance.

0 人收藏 0 人点赞
#medical-ai

新AI模型在测试中比人类医生提前多达3年发现胰腺癌

Reddit r/artificial · 2026-05-08 缓存

一种名为REDMOD的新AI模型通过分析CT扫描中的细微异常,能够比人类医生提前多达三年发现胰腺癌,这有望提高早期诊断率和生存率。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈