@ClementDelangue: 生物学的未来不应被黑盒API所束缚,尤其是当涉及个人健康时。无论你是……
摘要
Hugging Face 发布 Carbon,一个开源DNA基础模型,比同类模型快275倍,可在单个GPU上本地处理整个基因组。
查看缓存全文
缓存时间: 2026/05/20 12:30
生物学不应停留在黑箱API背后,尤其是当它关乎个人健康时。
无论你是@bryan_johnson测量每一项生物指标,还是@sytses公开分享并分析自己的免疫基因数据,你都需要开放、本地化、透明的AI。
@huggingface创立之初并非为了成为一家生物公司。这也不是我们最显而易见的专注领域。但这件事太过重要,不容忽视。
正因如此,我们构建并发布了Carbon:一个前沿的DNA基础模型,具备开放权重、训练代码和数据管道,专为下游生物学任务的微调或持续预训练而设计。
Carbon在同等规模下比次优模型快275倍,足以在你的笔记本电脑上本地运行。性能强大到可以在不到2天内用单GPU处理整个人类基因组。
技术突破:一个DNA原生分词器,将序列拆分为6碱基块以提高效率,同时在训练和推理过程中保持单碱基分辨率。让更多人能够检查、运行、微调、改进并基于这些塑造生物学的模型进行开发。
开放权重:https://huggingface.co/collections/HuggingFaceBio/carbon… 数据集:https://huggingface.co/datasets/HuggingFaceBio/carbon-pretraining-corpus… 演示:https://huggingface.co/spaces/HuggingFaceBio/carbon-demo…
开启开放AI生物学!
🧬 Carbon - HuggingFaceBio集合
来源:https://huggingface.co/collections/HuggingFaceBio/carbon
HuggingFaceBio (https://huggingface.co/HuggingFaceBio) 的集合
相似文章
@adithya_s_k: 醒醒吧大家 Huggingface 刚刚开源了基因组基础模型
Huggingface 开源了基因组基础模型,包括 Carbon,一个 DNA 模型,其速度比次优模型快 275 倍,并且可以在单个 GPU 上不到两天内处理整个人类基因组。
@lvwerra:我们正在发布Carbon:一个快得离谱的DNA模型。Carbon比第二好的模型快275倍。快到你可以处理……
HuggingFace发布了Carbon,一个DNA模型,比之前的最先进模型(Evo2)快275倍,使得在单个GPU上不到两天就能处理整个人类基因组。该模型使用了独特的tokenizer,将序列分割成6碱基的块,同时保持单碱基分辨率,并附带一个交互式演示。
Carbon:解码生命语言
Hugging Face 发布了 Carbon,一个开放的 DNA 基础模型系列,在匹配 Evo2-7B 最先进性能的同时,速度快 275 倍,采用 6-mer 分词、分解损失和精选的基因组数据。
@charles_irl: 从比特到生物
Modal宣布与Claude Science集成,为生命科学研究人员提供弹性计算服务,最多提供10万美元的承诺资源。
@arcinstitute: 生物学的未来是代理性的。我们很自豪能与NVIDIA合作开发Evo系列模型,并期待看到…
NVIDIA推出了BioNeMo Agent Toolkit,这是一个开放的工具包,使AI代理能够执行蛋白质结构预测、分子对接和生成化学等任务,与Arc Institute合作加速可编程生物学。