biomedical

标签

Cards List
#biomedical

让LLMs相互评判:用于医学问答的多智能体同行评审推理

arXiv cs.CL · 2026-06-16 缓存

本文介绍了一种多智能体同行评审推理方法,其中多个LLM独立生成思维链推理,然后相互评估输出以选择最佳答案。该方法在医学问答基准测试中优于单模型推理和多数投票。

0 人收藏 0 人点赞
#biomedical

基于大语言模型的少样本生物医学关系抽取:监督学习的可行替代方案?

arXiv cs.CL · 2026-06-16 缓存

本文研究了使用基于提示学习的大语言模型进行少样本生物医学关系抽取,比较了配对分类和联合生成两种方法。最佳模型实现了0.44的微F1值,显著优于此前的少样本结果,但仍低于监督基线。在宏F1值上,基于提示的方法在稀有关系类型上超越了监督基线,达到了0.45比0.38。

0 人收藏 0 人点赞
#biomedical

生物医学拉曼光谱的机器学习:从光谱采集到临床转化

arXiv cs.LG · 2026-06-15 缓存

本综述考察了机器学习在生物医学拉曼光谱流程中的作用,从预处理和信号校正到临床转化,强调了可靠Raman-AI系统的障碍和未来方向。

0 人收藏 0 人点赞
#biomedical

用于生物医学声明验证的小型LLM:经济高效的微调、结构化数据集捷径与跨域泛化

arXiv cs.CL · 2026-06-12 缓存

使用QLoRA对小型LLM(3B-7B)进行生物医学声明验证的微调,以44.5倍更低的成本实现了比GPT-4o和GPT-5更高的F1分数,并揭示了SciFact中的一个结构伪影。该研究表明,在结构合理的数据上进行训练可实现稳健的跨域迁移。

0 人收藏 0 人点赞
#biomedical

技能增强型AI代理在医学研究分析中的应用:一项NSCLC转录组生物标志物任务中的探索性多模型人类评估

arXiv cs.AI · 2026-06-11 缓存

本探索性研究在NSCLC生物标志物任务中使用多模型人类评估,评估将AI代理与医学研究技能包相结合是否能提高转录组研究分析输出的质量(与原生AI相比)。结果显示有方向性但无统计显著性的改善,强调了进行更大规模、更稳健评估的必要性。

0 人收藏 0 人点赞
#biomedical

@vanstriendaniel: Hugging Face 是涵盖所有领域(包括生物医学)的 AI 与 ML 的家园!@NIH 刚刚将 @huggingface Hu…

X AI KOLs Following · 2026-06-01 缓存

NIH 已将 Hugging Face Hub 添加到其官方通用存储库列表中用于数据共享,允许 NIH 资助的研究人员在数据共享计划中使用它。

0 人收藏 0 人点赞
#biomedical

超越一致性:为策展人筛选评分面板浮现的生物医学实体候选

arXiv cs.CL · 2026-06-01 缓存

本文介绍了BioConCal,一种监督评分器,它利用推理时的面板和候选特征对LLM面板浮现的生物医学实体候选进行排序,在策展人筛选方面显著优于原始一致性。

0 人收藏 0 人点赞
#biomedical

基于RAG的跨模型多数投票工作流评估ChatGPT在生物医学关联生成与验证中的协议

arXiv cs.CL · 2026-06-01 缓存

这篇arXiv论文提出了一种协议,用于评估ChatGPT在生成和验证生物医学关联方面的能力,采用基于RAG的跨模型多数投票工作流,以解决幻觉问题和本体论局限性。

0 人收藏 0 人点赞
#biomedical

BELIEF:面向生物医学问答的结构化证据建模与不确定性感知融合

arXiv cs.CL · 2026-05-19 缓存

BELIEF是一个面向生物医学问答的结构化证据建模与不确定性感知融合框架,它将检索到的文档转化为证据对象,并结合符号化Dempster-Shafer推理与基于LLM的推理。在PubMedQA、MedQA和MedMCQA上的实验表明,BELIEF在大多数设置下取得了最先进的结果。

0 人收藏 0 人点赞
#biomedical

MHGraphBench:基于知识图谱的大语言模型心理健康知识基准测试

arXiv cs.CL · 2026-05-18 缓存

本文介绍了MHGraphBench,这是一个基于知识图谱的基准测试,用于评估大语言模型在心理健康知识方面的能力,包括实体识别、关系判断和多跳推理。对15个LLM的实验揭示了识别能力与判断能力之间存在差距。

0 人收藏 0 人点赞
#biomedical

生物医学二分类中不平衡处理方法的系统评估

arXiv cs.LG · 2026-05-15 缓存

本文系统评估了五种不平衡处理方法(RUS、ROS、SMOTE、重加权、直接F1优化)在三个生物医学数据集(表格、文本、图像)上使用不同复杂度模型的效果。结果表明,收益取决于模型复杂度和数据模态,其中ROS、重加权和直接F1优化对非结构化数据上的复杂模型有效。

0 人收藏 0 人点赞
#biomedical

The biggest AI breakthrough in medicine & drug discovery

Reddit r/singularity · 2026-05-14 缓存

MAML is a novel multi-modal AI model that unifies understanding of chemistry, genetics, and proteins, outperforming specialized models on 11 drug discovery benchmarks, promising to accelerate pharmaceutical research and improve success rates.

0 人收藏 0 人点赞
#biomedical

用于评估知识图谱构建方法和图神经网络的统一基准

arXiv cs.LG · 2026-05-08 缓存

本文介绍了一个统一的基准测试,旨在评估图神经网络在基于文本构建的噪声知识图谱上的鲁棒性,以及生物医学领域图构建方法的有效性。

0 人收藏 0 人点赞
#biomedical

BioTool:用于增强大型语言模型生物医学能力的综合工具调用数据集

arXiv cs.CL · 2026-05-08 缓存

BioTool 引入了一个全面的生物医学工具调用数据集,包含34个工具和7,040个人工验证的查询-API对,使得经过微调的大型语言模型在生物医学工具使用上超越GPT-5.1,并显著提升答案质量。

0 人收藏 0 人点赞
#biomedical

隐形眼镜利用微流控技术监测并治疗青光眼

Hacker News Top · 2026-04-19 缓存

研究人员开发出一种无电子元件的智能隐形眼镜,通过微流控技术持续监测眼压,并在需要时自动释放青光眼药物,配合手机成像应用可实现94%的准确率。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈