@svpino:这个开源模型仅用 3.66B 参数就在 BIG-Bench Hard 逻辑子集上拿下 95.4%。TwIL-LM3-Pro 是一个……

X AI KOLs Following 模型

摘要

TwIL-LM3-Pro 是一个 3.66B 参数的开源模型,在 BIG-Bench Hard 逻辑子集上取得 95.4% 的成绩,体积小到可以直接在笔记本电脑本地运行,展示了针对特定任务的小模型进行专业化后训练的强大威力。

这个开源模型仅用 3.66B 参数就在 BIG-Bench Hard 逻辑子集上拿下 95.4%。 TwIL-LM3-Pro 是一个体积小到可以直接在笔记本电脑本地运行的模型。 专业化后训练真的太酷了。只要聚焦于特定任务,你就能获得大量小模型。 https://t.co/EwqiKKbr3t
查看原文
查看缓存全文

缓存时间: 2026/10/01 06:20

这个开源模型在 BIG-Bench Hard 的逻辑子集上得分 95.4%,参数量仅有 3.66B。

TwIL-LM3-Pro 小到可以在笔记本上本地运行。

专门化的后训练真的很酷。当你聚焦于特定任务时,可以得到大量小模型。 https://t.co/EwqiKKbr3t

David Stout (@Davidstout): 一个月内下载量达到五十万。今天,我们的开源家族又向前迈进了一步。

感谢大家对我们第一代模型的大力支持。我们很高兴推出 TwIL-LM3-Pro。

它仅拥有 36 亿参数,却带来了强大的推理能力

相似文章

MiniCPM5-1B 表明小模型竞赛尚未结束

Reddit r/ArtificialInteligence

MiniCPM5-1B 是 OpenBMB 推出的一个拥有 10 亿参数的模型,在 AIME 2025 和 τ2-Bench Telecom 上取得了令人瞩目的成绩,超越了更大的模型。它从单个检查点同时提供快速模式和推理模式,这得益于包括监督微调、强化学习和在线策略蒸馏在内的三阶段后训练过程。