@cryptoresetlife: 没有限制的模型好玩啊哈哈 本地LLM模型里现在最喜欢这个 Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核

X AI KOLs Timeline 模型

摘要

用户分享对本地LLM模型Qwen3.6 35B A3B的喜爱,该模型使用Opus 4.7蒸馏后无审核限制。

没有限制的模型好玩啊哈哈😁 本地LLM模型里现在最喜欢这个 Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核 https://t.co/j29SCkIsdD
查看原文
查看缓存全文

缓存时间: 2026/06/05 09:10

没有限制的模型好玩啊哈哈😁

本地LLM模型里现在最喜欢这个 Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核 https://t.co/j29SCkIsdD

相似文章

@zhixianio: 这两天新机器到了之后,我开始了「苦行僧」式的强迫自己使用本地模型来完成常见任务的修行 本以为会非常痛苦,没想到无论是速度还是质量都大大超出我的预期: 模型: Qwen3.6-35B-A3B-oQ6-fp16-mtp 运行:oMLX,开 N…

X AI KOLs Timeline

作者在本地新机器上使用Qwen3.6-35B-A3B模型和oMLX工具进行日常任务,发现速度和效果远超预期,甚至在PA和Coding场景下优于远程LLM,体现了端侧AI能力的显著提升。

@NFTCPS: 4GB显存跑70B大模型?这事儿真成了! AirLLM玩了个骚操作——分层推理,不一次性把模型怼进显存,而是一层层加载、算完就扔,硬生生把巨无霸塞进小破卡。 最骚的是:100%开源,白嫖警告 https://github.com/0xSo…

X AI KOLs Timeline

AirLLM 是一个完全开源的工具,通过分层推理技术(逐层加载并立即释放显存),使得 70B 大语言模型可在仅 4GB 显存的 GPU 上运行,无需量化、蒸馏或剪枝,并已支持 Llama3.1 405B 在 8GB 显存上运行。