medical-ai

标签

Cards List
#medical-ai

ClinSeekAgent:自动化多模态证据寻求以实现智能体临床推理

Hugging Face Daily Papers · 2026-05-19 缓存

ClinSeekAgent是一个自动化智能体框架,使大语言模型能够主动从原始数据源获取和综合多模态临床证据,提高纯文本和多模态任务中的决策准确性。它引入了ClinSeek-Bench基准和一个蒸馏模型ClinSeek-35B-A3B,该模型在智能体临床推理上取得了强劲性能。

0 人收藏 0 人点赞
#medical-ai

完全开放的 Meditron:用于临床 LLM 的可审计管道

arXiv cs.AI · 2026-05-18 缓存

介绍了完全开放的 Meditron,这是首个用于构建临床 LLM 的完全开放管道,具有临床医生审核的训练语料库和可重现框架,在全开放医学专科模型中达到领先水平。

0 人收藏 0 人点赞
#medical-ai

发现对抗肝纤维化的老药新用

Google DeepMind Blog · 2026-05-16 缓存

DeepMind的Co-Scientist AI在实验室测试中帮助识别了两种重新利用的药物,可阻断肝纤维化,其中一种抗癌药物阻断了91%的损伤反应,优于人类专家的选择。

0 人收藏 0 人点赞
#medical-ai

人工智能辅助的胎心监护:用于信号重建、胎心率分析和变异评估的统一模型

arXiv cs.LG · 2026-05-15 缓存

本文提出了一种基于AI的胎心率监测模型,该模型能够重建信号、分析变异,并以高灵敏度和特异性检测减速/加速。

0 人收藏 0 人点赞
#medical-ai

DT-Transformer:一个在真实世界健康系统上进行疾病轨迹预测的基础模型

arXiv cs.LG · 2026-05-15 缓存

DT-Transformer是一个基础模型,在Mass General Brigham(MGB)健康系统的11家医院中,基于170万名患者的5710万条结构化EHR记录进行训练,在896个疾病类别的下一事件预测中展现出强大的区分能力。

0 人收藏 0 人点赞
#medical-ai

量化并缓解前沿大语言模型中的过早闭合

arXiv cs.CL · 2026-05-15 缓存

本文定义并衡量了前沿大语言模型中的过早闭合现象,发现即使正确选项被移除或需要澄清时,模型仍频繁给出自信的回答,凸显了医疗应用中的一个关键安全问题。

0 人收藏 0 人点赞
#medical-ai

安大略省医生使用的AI转录工具出现‘幻觉’和错误,审计员发现 | CBC News

Reddit r/artificial · 2026-05-13 缓存

安大略省审计长发现,医生使用的AI转录工具产生错误和幻觉,可能危及患者护理,并批评政府测试不足。

0 人收藏 0 人点赞
#medical-ai

Checkup2Action:用于生成面向患者的行动卡片的临床体检报告多模态数据集

arXiv cs.CL · 2026-05-13 缓存

本文介绍了Checkup2Action,这是一个用于从临床体检报告生成面向患者的行动卡片的多模态数据集和基准测试,旨在解决普通患者理解医疗报告的困难。

0 人收藏 0 人点赞
#medical-ai

ClinicalBench:对 MIMIC-IV 跨入院临床问答中基于断言感知的检索进行压力测试

arXiv cs.CL · 2026-05-13 缓存

本文介绍了 ClinicalBench 和 EpiKG 系统,评估了针对 MIMIC-IV 数据在多个人工智能大语言模型(LLM)上的临床问答中基于断言感知的检索能力。研究证明,在检索过程中处理否定和时态信息,相比标准基线能显著提升性能。

0 人收藏 0 人点赞
#medical-ai

AntAngelMed - 100a6b 医疗大模型

Reddit r/LocalLLaMA · 2026-05-13 缓存

AntAngelMed 是由浙江省卫生健康信息中心、阿里健康(Ant Healthcare)以及安贞儿医疗 AI(Anzhen'er Medical AI)联合开发并开源的全新 1000 亿参数医疗大模型。该模型采用高效的 MoE(混合专家)架构以实现高性能推理,并在 HealthBench 和 MedAIBench 基准测试中取得了领先排名。

1 人收藏 1 人点赞
#medical-ai

@TeksEdge:全球首个开源 100B 医疗大模型已发布。本地推理者现在可以在家中运行健康模型选项。安...

X AI KOLs Timeline · 2026-05-12

浙江省人民医院与蚂蚁集团发布了 AntAngelMed,这是一个拥有 100B 参数的开源医疗大模型,在 MedBench 上排名前列,并支持高效且高隐私保护的本地推理。

0 人收藏 0 人点赞
#medical-ai

MedAction:迈向主动式多轮临床诊断大语言模型

arXiv cs.CL · 2026-05-11 缓存

本文介绍了 MedAction 框架,该框架通过模拟迭代式的检查开具与假设更新,训练大语言模型(LLM)进行主动的多轮临床诊断。文章提出了一个新的数据集 MedAction-32K,并展示了开源模型在医学基准测试上的最先进水平(SOTA)性能。

0 人收藏 0 人点赞
#medical-ai

STDA-Net:基于频谱图的跨数据集睡眠分期领域适应

arXiv cs.LG · 2026-05-11 缓存

本文介绍了STDA-Net,一种利用2D频谱图和对抗学习进行跨数据集睡眠分期的领域适应框架。在公共数据集上,与现有的1D EEG基线方法相比,该方法显示出更高的准确性和稳定性。

0 人收藏 0 人点赞
#medical-ai

MedExAgent:在嘈杂的临床环境中训练大语言模型代理进行询问、检查与诊断

arXiv cs.CL · 2026-05-11 缓存

本文介绍了 MedExAgent,这是一个将临床诊断形式化为部分可观测马尔可夫决策过程(POMDP)以处理嘈杂和不完整信息的框架。该框架提出了一种结合监督微调与强化学习的两阶段训练流程,以提高医疗大语言模型的诊断准确性和成本效益。

0 人收藏 0 人点赞
#medical-ai

@FinanceYF5: 3/ 准确性提升 GPT-5.5 Instant 在事实准确性上有明显提升。 尤其是在医学、法律、金融等对准确性要求更高的领域。

X AI KOLs Following · 2026-05-10 缓存

Report claims that GPT-5.5 Instant shows significant improvements in factual accuracy, particularly in high-stakes fields like medicine, law, and finance.

0 人收藏 0 人点赞
#medical-ai

新AI模型在测试中比人类医生提前多达3年发现胰腺癌

Reddit r/artificial · 2026-05-08 缓存

一种名为REDMOD的新AI模型通过分析CT扫描中的细微异常,能够比人类医生提前多达三年发现胰腺癌,这有望提高早期诊断率和生存率。

0 人收藏 0 人点赞
#medical-ai

基于优化深度学习与 LLM 驱动智能 AI 在计算受限系统上进行膝关节骨关节炎严重程度分级

arXiv cs.AI · 2026-05-08 缓存

本文介绍了一种用于分级膝关节骨关节炎严重程度的自动化诊断系统,该系统使用通过 TensorFlow Lite 部署在边缘设备上的优化 ResNet-18 模型。它集成了使用 Gemini 2.0 Flash 的大型语言模型(LLM)接口,在提供结构化解释性发现的同时,保持了在资源受限环境下的离线能力。

0 人收藏 0 人点赞
#medical-ai

可解码但无法通过固定残差流线性转向纠正:来自医疗大语言模型失效模式的证据

arXiv cs.AI · 2026-05-08 缓存

本文研究了大语言模型隐藏状态中线性可解码的失效信号是否可以通过残差流转向进行纠正。研究发现,虽然“过度思考”失效模式是可解码的,但由于其与任务关键计算的表示纠缠,固定的线性转向未能纠正这些失效,尽管探测探针有效地支持了选择性拒绝回答。

0 人收藏 0 人点赞
#medical-ai

将漂移转化为约束:非平稳环境下的鲁棒推理对齐

Hugging Face Daily Papers · 2026-05-02 缓存

本文引入了 CXR-MAX,这是一个大规模基准,旨在利用来自多个多模态大语言模型(MLLM)的 X 射线数据,评估非平稳环境下的推理对齐性能。

0 人收藏 0 人点赞
#medical-ai

CGM-JEPA:通过预测性自监督预训练学习一致的连续血糖监测表征

Hugging Face Daily Papers · 2026-05-01 缓存

介绍 CGM-JEPA,这是一种针对连续血糖监测数据的自监督预训练框架,通过掩码潜在预测和分布目标提升了跨模态及跨队列的性能。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈