@cryptoresetlife: 没有限制的模型好玩啊哈哈 本地LLM模型里现在最喜欢这个 Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核
摘要
用户分享对本地LLM模型Qwen3.6 35B A3B的喜爱,该模型使用Opus 4.7蒸馏后无审核限制。
没有限制的模型好玩啊哈哈😁
本地LLM模型里现在最喜欢这个
Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核 https://t.co/j29SCkIsdD
查看缓存全文
缓存时间: 2026/06/05 09:10
没有限制的模型好玩啊哈哈😁
本地LLM模型里现在最喜欢这个 Qwen3.6 35B A3B用Opus 4.7蒸馏后无审核 https://t.co/j29SCkIsdD
相似文章
@zhixianio: 这两天新机器到了之后,我开始了「苦行僧」式的强迫自己使用本地模型来完成常见任务的修行 本以为会非常痛苦,没想到无论是速度还是质量都大大超出我的预期: 模型: Qwen3.6-35B-A3B-oQ6-fp16-mtp 运行:oMLX,开 N…
作者在本地新机器上使用Qwen3.6-35B-A3B模型和oMLX工具进行日常任务,发现速度和效果远超预期,甚至在PA和Coding场景下优于远程LLM,体现了端侧AI能力的显著提升。
@KtAIFeed: 直接上干货,不废话。 最近火爆 Hugging Face(单月下载超百万)的 Qwen 3.6(35B/43B)最新开源“无限制”模型,最低单卡 6G 显存就能在本地跑起来,彻底砸碎了官方原版的道德说教和安全限制,无审查,你聊它就回答什么…
介绍Qwen 3.6(35B/43B)开源无限制模型,移除官方道德与安全限制,最低6G显存即可本地运行,下载量超百万。
@akazwz_: 准备用起来了,qwen3.8 27b,现在 ollama 直接支持 mac 的 mlx 很舒服。
用户表示准备使用 Qwen 3.8 27b 模型,现在 Ollama 直接支持 Mac 的 MLX,使用起来很舒适。
@NFTCPS: 4GB显存跑70B大模型?这事儿真成了! AirLLM玩了个骚操作——分层推理,不一次性把模型怼进显存,而是一层层加载、算完就扔,硬生生把巨无霸塞进小破卡。 最骚的是:100%开源,白嫖警告 https://github.com/0xSo…
AirLLM 是一个完全开源的工具,通过分层推理技术(逐层加载并立即释放显存),使得 70B 大语言模型可在仅 4GB 显存的 GPU 上运行,无需量化、蒸馏或剪枝,并已支持 Llama3.1 405B 在 8GB 显存上运行。
@itsPaulAi: 真不敢相信 Qwen3.8-27B 性能匹敌 Opus 4.6 Max... 这个模型在短短 6 个月前还是最好(也是最昂贵的)……
Qwen3.8-27B 是一个拥有 270 亿参数、开放权重的 AI 模型,性能匹敌 Opus 4.6 Max,并且可以在笔记本电脑上本地运行。