@rohanpaul_ai:中国最强的小型推理模型(VibeThinker-3B)刚刚被一个来自奥斯汀的 3.6B 模型击败。> webAI 的 TwIL-LM3-Pro…

X AI KOLs Timeline 模型

摘要

webAI 发布了 TwIL-LM3-Pro,一个 3.66B 的开源推理模型,在形式逻辑基准测试上超越了 VibeThinker-3B、Qwen3.5-4B 和 LFM2.5-8B-A1B,并可通过 llama.cpp 以约 2 GiB 的 Q4 构建在本地运行。

中国最强的小型推理模型(VibeThinker-3B)刚刚被一个来自奥斯汀的 3.6B 模型击败。 > webAI 的 TwIL-LM3-Pro 是一个 3.66B 的本地模型,将 IBM Granite 在形式逻辑上的得分提升了 28% > 推荐的 Q4 构建是一个 2.09 GiB 的文件,可通过 llama.cpp 在 CPU 或本地 GPU 上运行,因此私有数据可以留在设备上。 > TwIL-LM3-Pro 现已在形式逻辑方面领先于 webAI 对比的所有小型模型,得分比微博的 VibeThinker-3B 高出约 35%,比 Qwen3.5-4B 高出 24%,比 Liquid AI 的 LFM2.5-8B-A1B 高出 47%。
查看原文
查看缓存全文

缓存时间: 2026/10/01 12:22

中国最强的轻量推理模型(VibeThinker-3B)刚刚被一个来自奥斯汀的 3.6B 模型击败。

webAI 的 TwIL-LM3-Pro 是一个 3.66B 参数的本地模型,将 IBM Granite 的形式逻辑得分提升了 28%

推荐的 Q4 版本文件大小为 2.09GiB,可通过 llama.cpp 在 CPU 或本地 GPU 上运行,因此隐私数据可以保留在设备本地。

TwIL-LM3-Pro 在形式逻辑测试中领先 webAI 对比过的所有小型模型,得分比微博的 VibeThinker-3B 高约 35%,比 Qwen3.5-4B 高 24%,比 Liquid AI 的 LFM2.5-8B-A1B 高 47%。

David Stout (@Davidstout): 一个月内下载量达到五十万次。今天,我们的开源模型家族又向前迈进了一步。

感谢大家对我们第一代模型的鼎力支持。我们很高兴正式推出 TwIL-LM3-Pro。

它仅有 30 亿参数,便能提供强大的推理能力……

相似文章