TxBench: 抗体发现 (13分钟阅读)
摘要
TxBench 是一个用于抗体发现的基准测试,可能评估该生物技术领域中的计算或AI驱动的方法。
TxBench-AB 是一个新型的AI基准测试,用于评估LLMs在生物医学研究中的有效性。
查看缓存全文
缓存时间: 2026/09/03 23:55
该内容似乎不是可翻译的文档或文本,而是PDF文件的原始二进制数据流。其中包含PDF生成参数(如压缩设置、图像处理指令等)和编码数据,而非可读的Markdown格式文章。因此无法进行常规的文本翻译。
如需翻译,请提供实际的Markdown文本内容。
相似文章
TxBench-PP:分析AI代理在小分子临床前药理学上的表现
TxBench-PP是一个用于评估AI代理在小分子临床前药理学任务上表现的基准测试。在16种模型-框架配置中,最佳系统仅达到59.3%的准确率,表明仍有很大的改进空间。
EpiBench:LLMs 能否理解抗体药物发现中的表位?
EpiBench 是一个新的闭卷、基于序列的基准,用于评估 LLMs 在五项抗体药物发现任务中对表位的理解程度,结果发现当前模型能捕获部分信号,但在抗体特异性推理方面存在困难。
GeneBench-Pro 介绍
OpenAI 推出 GeneBench-Pro,这是一个研究级基准,旨在测试 AI 代理在计算生物学中进行需要大量判断的分析的能力,涵盖基因组学、定量生物学和转化医学。
PhenoBench:一项深度表型化人群队列研究能告诉我们什么
PhenoBench 是一项可执行基准测试,旨在利用深度表型化的人群队列评估AI模型在临床任务上的表现,其结果显示基础模型相较于标准方法仅展现出有限的聚合改进。
BixBench3:前沿AI智能体现在可以复现约48%的真实计算生物学研究工作流程
本文介绍BixBench3,一个用于评估AI代理在计算生物学任务上的基准,表明前沿LLMs可以复现约48%的真实研究工作流程,但在处理大型数据集和顺序步骤方面存在困难。