unsloth

标签

Cards List
#unsloth

@no_stp_on_snek: 哦,不错。这个会很有趣

X AI KOLs Timeline ↗ · 2026-07-31 缓存

对 Unsloth AI 的回复,表达了对传闻中的 DeepSeek-V4-Flash 模型的兴奋,以及通过量化版本在本地运行它的可能性。

0 人收藏 0 人点赞
#unsloth

unsloth/DeepSeek-V4-Flash-0731-GGUF

Reddit r/LocalLLaMA ↗ · 2026-07-31

Unsloth 预告了即将在 Hugging Face 上发布的 DeepSeek V4 Flash GGUF 量化模型。

0 人收藏 0 人点赞
#unsloth

Unsloth 推出的 Laguna S 2.1 量化版本已发布

Reddit r/LocalLLaMA ↗ · 2026-07-22 缓存

Unsloth 发布了 Laguna S 2.1 Mixture-of-Experts 模型的 GGUF 量化版本。该模型是一个拥有 118B 参数(8B 激活参数)的编码模型,具备 1M 上下文窗口和智能体能力。量化版本支持高效的本地部署。

0 人收藏 0 人点赞
#unsloth

I benchmarked Unsloth's Qwen3.6-27B NVFP4 on 1x/2x 5090s. MTP is great until it really isn't.

Reddit r/LocalLLaMA ↗ · 2026-07-21

详细基准测试:Unsloth的Qwen3.6-27B NVFP4模型在RTX 5090 GPU上的表现,显示MTP(多令牌预测)在短上下文的单次请求中能显著加速,但在批量并发或长上下文场景下则会带来不利影响。

0 人收藏 0 人点赞
#unsloth

Unsloth 现已支持 AMD!

Reddit r/LocalLLaMA ↗ · 2026-07-20

Unsloth,这个高效的 LLM 微调库,现已支持 AMD GPU,扩展了硬件可访问性。

0 人收藏 0 人点赞
#unsloth

在样本量低于1万时,qlora的默认学习率2e-4是错误的,却没有人讨论[D]

Reddit r/MachineLearning ↗ · 2026-07-16

作者认为,对于样本量低于1万的数据集,QLoRA微调中常用的2e-4学习率过高,会导致过拟合和评估效果不佳,并建议使用更低的学习率,如1e-4。

0 人收藏 0 人点赞
#unsloth

unsloth/inkling-GGUF

Hugging Face Models Trending ↗ · 2026-07-14 缓存

unsloth/inkling-GGUF 页面提供了 Inkling 的量化 GGUF 版本。Inkling 是 Thinking Machines 开发的一个 975B 参数的多模态 MoE 模型(41B 活跃),设计用于文本、图像和音频输入,拥有开放权重,并支持通过 Unsloth、SGLang 和 vLLM 等库进行本地部署。

0 人收藏 0 人点赞
#unsloth

@UnslothAI: 我们与 AWS 合作,撰写了一份关于 LLM 量化和部署的完整指南。了解:• 模型格式、动态…

X AI KOLs Timeline ↗ · 2026-07-13 缓存

Unsloth 与 AWS 合作,撰写了一份关于在 Amazon SageMaker 上对 LLM 进行动态量化和部署的全面指南,涵盖模型格式、工具和最佳实践。

0 人收藏 0 人点赞
#unsloth

@sakurayukiai: 通过计算推测模型的KV缓存字节数(而非将其隐藏在平坦的显存缓冲中),Unsloth将Qwen…

X AI KOLs Timeline ↗ · 2026-07-13

Unsloth通过精确计算推测模型的KV缓存字节数(而非使用平坦的显存缓冲),将Qwen3.6-27B Q6_K在单张32GB显卡上的上下文长度从23K提升至64K。

0 人收藏 0 人点赞
#unsloth

Voodoo Quant 在 Qwen3.5 0.8B 和 2B 模型上超越 Unsloth Dynamic 2.0 KLD 95%

Reddit r/LocalLLaMA ↗ · 2026-07-12

量化方法 Voodoo Quant 在 Qwen3.5 0.8B 和 2B 模型上性能超越 Unsloth Dynamic 2.0 KLD 95%

0 人收藏 0 人点赞
#unsloth

在4块RTX 5060 Ti上,使用P2P和PP=4,对新的unslooth/Qwen3.6-27B-NVFP4在并发数为1、4、8、12和16下的基准测试

Reddit r/LocalLLaMA ↗ · 2026-07-11

unslooth/Qwen3.6-27B-NVFP4模型在4块RTX 5060 Ti GPU上,使用点对点(P2P)和流水线并行(PP)在不同并发级别下的基准测试结果。

0 人收藏 0 人点赞
#unsloth

@0xkeenz: 有意思,昨天刚好还在研究 Unsloth 和 NVIDIA 的 Qwen3.6 27B NVFP4 有什么区别,结果今天 Unsloth 就更新了! 新版 Unsloth 的量化思路和 NVIDIA 官方方案很类似:不再从 BF16 和 …

X AI KOLs Timeline ↗ · 2026-07-10 缓存

Unsloth 发布新版 Qwen3.6 27B NVFP4 量化方案,引入 FP8_E4M3 中间精度层并细化权重保护,在 24GB VRAM 上实现 2.5 倍速度提升,同时改进准确性和工具调用能力。

0 人收藏 0 人点赞
#unsloth

@no_stp_on_snek: 这太厉害了!3090 级别的 GPU 欢呼吧!

X AI KOLs Following ↗ · 2026-07-10 缓存

Unsloth AI 发布了量化版 Qwen3.6 模型,在消费级 GPU 上运行速度快了 2.5 倍。其中 27B 模型可适配 24GB 显存,35B-A3B 模型实现了高吞吐量。

1 人收藏 1 人点赞
#unsloth

2.5倍更快的Qwen3.6 NVFP4 Unsloth量化版本

Reddit r/LocalLLaMA ↗ · 2026-07-10

Unsloth推出使用NVFP4格式的量化Qwen3.6模型,推理速度提升2.5倍。

0 人收藏 0 人点赞
#unsloth

Unsloth GLM-5.2 – 如何在本地运行

Hacker News Top ↗ · 2026-06-22 缓存

使用Unsloth Dynamic GGUFs在本地运行Z.ai的开放模型GLM-5.2的指南。该模型拥有744B总参数量(40B活跃),1M上下文窗口,量化版本可将内存降至2-bit的239GB,使得在256GB Mac上实现本地推理成为可能。

0 人收藏 0 人点赞
#unsloth

对本地LLM如Qwen 3:0.6B进行微调以对问题分类,效果良好

Hacker News Top ↗ · 2026-06-21 缓存

一位开发者使用Unsloth框架对小型Qwen 3 0.6B模型进行微调,用于对家庭问题进行分类,仅用850个训练样本便取得了良好效果。

0 人收藏 0 人点赞
#unsloth

@SlimTradeyBaby: 在下方列出你的GPU,我会告诉你运行什么模型和配置。开玩笑的。没必要。Qwen 3.6 27b @Unsloth…

X AI KOLs Timeline ↗ · 2026-06-20 缓存

一条推广Qwen 3.6 27b模型并推荐UnslothAI在任何GPU上运行它的推文。

0 人收藏 0 人点赞
#unsloth

@10xmylife: Unsloth 成功将 2-bit 版本的 GLM-5.2 部署在了 256GB 的 Mac 上

X AI KOLs Following ↗ · 2026-06-19 缓存

Unsloth 成功将 GLM-5.2 模型以 2-bit 量化压缩至 238GB,可在 256GB Mac 上本地运行,保留约 82% 的准确率。

0 人收藏 0 人点赞
#unsloth

@UnslothAI: GLM-5.2 现在可以本地运行!2-bit 模型在从 1.51TB 缩小到 238GB(-84% 大小)后保留了约 82% 的准确率…

X AI KOLs Timeline ↗ · 2026-06-18 缓存

UnslothAI 宣布 GLM-5.2,Z.ai 的最强开源模型,拥有 744B 参数,现在可以通过动态 GGUF 量化在本地运行,将大小减少约 84% 至 239GB,同时保留约 82% 的准确率。它适用于 256GB Mac 以及 RAM/VRAM 配置,并支持长上下文、推理和代理任务。

0 人收藏 0 人点赞
#unsloth

@aisearchio: GLM 5.2 GGUF 已经来了!8位版本大小约为完整模型的一半。更小版本即将推出 https://huggingfa…

X AI KOLs Timeline ↗ · 2026-06-17 缓存

GLM 5.2 GGUF 量化模型已发布,8位版本大小约为完整模型的一半;更小版本即将推出。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈