@Davidstout:一个月内下载量突破五十万。今天,我们的开源家族又迈出了新的一步。感谢大家难以置信的……

X AI KOLs Timeline 模型

摘要

webAI 推出 TwIL-LM3-Pro,一款 36 亿参数的开源推理模型,可通过量化版本在日常电脑本地运行。在形式逻辑、SVAMP、MuSR 和 BIG-Bench Hard 等基准测试中,该模型在小型模型中取得最高分。他们还预告了 Meridian——即将推出的前沿级端侧模型系列。

一个月内下载量突破五十万。今天,我们的开源家族又迈出了新的一步。 感谢大家对我们第一代模型的鼎力支持。我们很高兴推出 TwIL-LM3-Pro。 它仅有 36 亿参数,却能将强大的推理能力带到日常电脑上,提供可在本地运行的量化版本。无需云端。 在我们的评测中: 形式逻辑:在参与对比的小型模型中创下最高的头条成绩——比中国的 VibeThinker-3B 高 35%,比 Qwen3.5-4B 高 24%,比 Liquid AI 的 LFM2.5-8B-A1B 高 47%。 更广泛的推理能力:SVAMP 得分 95%,MuSR 得分 64.1%,均为参与对比的小型模型中创下的最高分。 BIG-Bench Hard 逻辑子集:95.4%,而 VibeThinker-3B 为 61.1%。 我们认为 AI 正在进入后训练时代。优势将越来越属于那些拥有最佳流程的公司,以及能够更快、更高效地打造出强大且个性化智能的公司,并将其部署到人们已有的设备上。 这正是我们在 webAI 所构建的方向。而我们才刚刚开始分享实验室中即将推出的内容。 即将推出:Meridian——我们为端侧运行而构建的前沿级模型系列。我们最先进的模型将通过 @thewebAI 应用提供。 在我们扩大开放访问之际,欢迎加入等候名单。自豪地构建于德克萨斯州奥斯汀。🇺🇸
查看原文
查看缓存全文

缓存时间: 2026/10/01 08:20

一个月下载量突破五十万次。今天,我们的开源家族又迈出了重要一步。

感谢大家对第一代模型的大力支持。我们很高兴地推出 TwIL-LM3-Pro。

它仅有 36 亿参数,却能为日常电脑带来强大的推理能力,并提供可本地运行的量化版本。无需云端。

在我们的评测中:

**形式逻辑:**在对比的同类小模型中创下最高的公开成绩——比中国的 VibeThinker-3B 高出 35%,比 Qwen3.5-4B 高出 24%,比 Liquid AI 的 LFM2.5-8B-A1B 高出 47%。

**更广泛的推理能力:**在 SVAMP 上达到 95%,在 MuSR 上达到 64.1%,均为对比同类小模型中的最高公开成绩。

**BIG-Bench Hard 的逻辑子集:**95.4%,相比之下 VibeThinker-3B 为 61.1%。

我们认为,AI 正迈入后训练时代。未来的竞争优势将越来越属于拥有最佳流水线的公司,以及那些能够更快、更高效地生产出强大且个性化智能、并将其部署到人们现有设备上的公司。

这正是我们在 webAI 所做的事,而实验室中即将产出的成果,我们也才刚刚开始分享。

**即将推出:**Meridian——我们专为设备端运行打造的前沿级模型系列。我们最先进的模型将通过 @thewebAI 应用提供。

随着访问权限逐步开放,欢迎加入等候名单。自豪地打造于美国得克萨斯州奥斯汀。🇺🇸

相似文章