标签
一项合作研究的发现表明,在训练蛋白质语言模型时,丢弃宏基因组数据集中的单体蛋白质可能是不正确的。
一项对冰人奥茨微生物组的研究揭示了仍然存活着的古老酵母和细菌菌株,为了解他这一人生态系统提供了见解。
TaxDistill提出了一种知识蒸馏框架,使用拥有5亿参数的基因组基础模型(GenomeOcean)作为教师模型,通过减少相似性搜索工具带来的标签噪声来改进宏基因组分类注释,在CAMI2数据集上实现了显著的F1分数提升。