@UnslothAI:4-bit Qwen3.6 MTP GGUF 成功从单个提示中搜索70多个网站。通过 Unsloth Studio 在20GB内存上本地尝试…

X AI KOLs Timeline 工具

摘要

UnslothAI 宣布,其 4-bit Qwen3.6 MTP GGUF 模型仅凭单个提示即可搜索超过70个网站,通过 Unsloth Studio 可在20GB内存上本地运行。此次更新增加了自动 MTP 和推测解码支持。

4-bit Qwen3.6 MTP GGUF 成功从单个提示中搜索了70多个网站。 通过 Unsloth Studio 在20GB内存上本地尝试。 Unsloth 现在支持自动 MTP + 推测解码,并可自动为您的设备(Mac, CPU, GPU)选择最佳 MTP 设置。 GitHub: https://t.co/aZWYAtakBP https://t.co/DwGVNMCfRV
查看原文
查看缓存全文

缓存时间: 2026/05/20 02:24

Unsloth Studio 让您能在本地运行和训练模型。功能 • 快速入门 • 笔记本 • 文档

相似文章

Unsloth 上的 MTP

Reddit r/LocalLLaMA

Unsloth 发布了支持多 Token 预测 (MTP) 的 Qwen3.6 模型 GGUF 量化版本。

unsloth/Qwen3.6-27B-MTP-GGUF

Hugging Face Models Trending

Unsloth 发布了 Qwen3.6-27B 模型的 GGUF 权重,该模型支持多令牌预测(MTP),可实现更快的生成速度并增强了智能体(Agentic)编码能力。

havenoammo/Qwen3.6-27B-MTP-UD-GGUF

Hugging Face Models Trending

该 Hugging Face 仓库提供了 Qwen3.6-27B 的 GGUF 文件,这些文件在 Unsloth UD XL 量化版本的基础上嫁接了多 Token 预测 (MTP) 层。它还包含了构建支持 MTP 的 llama.cpp 的说明,以实现投机解码。