@svpino:小巧、专业且开源的模型才是未来!TwiL-LM 模型系列现已在 HuggingFace 上发布,供 Tra…

X AI KOLs Timeline 模型

摘要

TwiL-LM 是一系列小巧的专用开源模型,现已发布在 HuggingFace 上。其中 3B 版本在形式推理基准测试上优于 OpenAI 的 120B gpt-oss 模型,并且能在消费级硬件上高效运行。

小巧、专业且开源的模型才是未来! TwiL-LM 模型系列现已在 HuggingFace 上发布,支持 Transformers 和 llama.cpp,采用非商业许可。 为了让您了解这些小巧模型有多出色: 1. 3B 版本在 4/5 项形式推理基准测试中击败了 OpenAI 的 120B gpt-oss 模型,尽管其体积小了 40 倍。 2. 在 webAI 的吞吐量测试中,3B 版本比 gpt-oss-120b 快 2.6 倍。 3. 1.7B 版本仅有 1.06 GB,可在手机和笔记本电脑上本地运行,速度约为 367 tokens/秒。 这些模型专为演绎推理、结构化输出、工具调用和逻辑验证而构建,而非试图成为通用型大语言模型。
查看原文
查看缓存全文

缓存时间: 2026/08/11 05:41

小型、专用且开放模型才是未来!

TwiL-LM 系列模型现已在 HuggingFace 上提供,支持 Transformers 和 llama.cpp,采用非商业许可协议。

为了让您直观感受这些小模型的实力:

  1. 3B 版本在 4/5 的正式推理基准上击败了 OpenAI 的 120B gpt-oss 模型,尽管体积小 40 倍。
  2. 3B 版本在 webAI 的吞吐量测试中比 gpt-oss-120b 快 2.6 倍。
  3. 1.7B 版本仅 1.06 GB,可在手机和笔记本电脑上本地运行,速度约为 367 tokens/秒。

这些模型专门为演绎推理、结构化输出、工具调用和逻辑验证而构建,而不是试图成为通用型 LLM。

David Stout (@Davidstout): 今天,我们很高兴地开源 TwiL-LM3,这是 webAI Intelligence Lab 推出的首个形式化推理模型。

TwiL-LM3 仅有 30 亿参数,却在 5 个形式化推理基准中的 4 个上超越了 OpenAI 的 GPT-OSS-120B,同时还能在消费级硬件上高效运行。那就是

相似文章

LiquidAI/LFM2.5-VL-3B · Hugging Face

Reddit r/LocalLLaMA

LiquidAI releases LFM2.5-VL-3B, a 3B multimodal model for on-device deployment with improved OCR, grounding, and efficient inference, available in multiple formats including GGUF, ONNX, and MLX.

小型模型已至

Hacker News Top

本文讨论了像GPT-5.6-luna和GLM 5.3这样的小型且经济高效的AI模型如何变得既强大又实惠,降低推理成本,为消费和商业AI应用开启新可能。