@ClementDelangue: 生物学的未来不应被黑盒API所束缚,尤其是当涉及个人健康时。无论你是……

X AI KOLs Following 模型

摘要

Hugging Face 发布 Carbon,一个开源DNA基础模型,比同类模型快275倍,可在单个GPU上本地处理整个基因组。

生物学的未来不应被黑盒API所束缚,尤其是当涉及个人健康时。 无论你是@bryan_johnson 测量每一项生物指标,还是@sytses 公开分享和分析自己的免疫遗传学数据,你都需要开放、本地、透明的人工智能。 @huggingface 的初衷并非成为一家生物学公司。这对我们来说也不是最显而易见的专注方向。但这件事如此重要,以至于我们不得不有所行动。 因此,我们构建并发布了 Carbon:一个前沿DNA基础模型,拥有开放权重、训练代码和数据管道,专为下游生物学任务的微调或持续预训练而设计。 Carbon 的速度是同等规模下最佳模型的275倍。快到可以在你的笔记本电脑上本地运行。强大到可以在不到两天的时间内,在单个GPU上处理整个人类基因组。 技术突破:一个DNA原生的分词器,将序列分割成6碱基块以提高效率,同时在训练和推理过程中保持单碱基分辨率。让更多人能够检查、运行、微调、改进并基于这些塑造生物学的模型进行开发。 开放权重:https://huggingface.co/collections/HuggingFaceBio/carbon… 数据集:https://huggingface.co/datasets/HuggingFaceBio/carbon-pretraining-corpus… 演示:https://huggingface.co/spaces/HuggingFaceBio/carbon-demo… 让我们一起推动开放的AI生物学!
查看原文
查看缓存全文

缓存时间: 2026/05/20 12:30

生物学不应停留在黑箱API背后,尤其是当它关乎个人健康时。

无论你是@bryan_johnson测量每一项生物指标,还是@sytses公开分享并分析自己的免疫基因数据,你都需要开放、本地化、透明的AI。

@huggingface创立之初并非为了成为一家生物公司。这也不是我们最显而易见的专注领域。但这件事太过重要,不容忽视。

正因如此,我们构建并发布了Carbon:一个前沿的DNA基础模型,具备开放权重、训练代码和数据管道,专为下游生物学任务的微调或持续预训练而设计。

Carbon在同等规模下比次优模型快275倍,足以在你的笔记本电脑上本地运行。性能强大到可以在不到2天内用单GPU处理整个人类基因组。

技术突破:一个DNA原生分词器,将序列拆分为6碱基块以提高效率,同时在训练和推理过程中保持单碱基分辨率。让更多人能够检查、运行、微调、改进并基于这些塑造生物学的模型进行开发。

开放权重:https://huggingface.co/collections/HuggingFaceBio/carbon… 数据集:https://huggingface.co/datasets/HuggingFaceBio/carbon-pretraining-corpus… 演示:https://huggingface.co/spaces/HuggingFaceBio/carbon-demo…

开启开放AI生物学!


🧬 Carbon - HuggingFaceBio集合

来源:https://huggingface.co/collections/HuggingFaceBio/carbon

HuggingFaceBio (https://huggingface.co/HuggingFaceBio) 的集合

相似文章

Carbon:解码生命语言

Reddit r/LocalLLaMA

Hugging Face 发布了 Carbon,一个开放的 DNA 基础模型系列,在匹配 Evo2-7B 最先进性能的同时,速度快 275 倍,采用 6-mer 分词、分解损失和精选的基因组数据。

@charles_irl: 从比特到生物

X AI KOLs Timeline

Modal宣布与Claude Science集成,为生命科学研究人员提供弹性计算服务,最多提供10万美元的承诺资源。