Qwen3.6-35B-A3B-Abliterated-Heretic-MLX-4bit
摘要
用户评价了通过MLX为Apple Silicon优化的Qwen3.6-35B模型的量化微调版本,称赞其速度快、智能化程度高且没有安全免责声明。
这款模型是通用聊天机器人模型中的GOAT。极其聪明,快如闪电(Apple Silicon),并且毫无免责声明地讲真话。如果以后还能变得更好,我绝对会惊掉下巴。惊掉下巴。
相似文章
Qwen3.8-27B 在 Apple Silicon 上借助 mlx-dspark 速度提升至约3倍
mlx-dspark v0.10.0 新增了对 Apple Silicon 上 Qwen3.8-27B 的支持,通过无损验证的推测解码提供高达3倍的速度提升。
@Daniel_Farinax: 在 MacBook Pro M5 128GB MLX 上使用定制编码 CLI 优化运行 Qwen3.6-27B。也适用于 M1、M2、M3、M4 Mac…
Daniel Farinax 宣布推出一个定制 CLI,用于在 MacBook 上通过 MLX 运行 Qwen3.6-27B,正在招募测试人员,并转向 TypeScript 以加快迭代速度。
Qwen/Qwen3.6-35B-A3B-FP8
阿里巴巴发布了Qwen3.6-35B-A3B-FP8,这是Qwen3.6的开源权重量化变体,拥有35B参数,通过MoE激活3B,具有改进的智能编码能力和保持思维链的迭代开发特性。
@dealignai: Qwen3.6-27b 和 35b 的 MXFP4 与 MXFP8 CRACK 版本现已推出,支持 MTP。尽享无审查的极速体验!35b mxfp4: https://huggingface…
DealignAI 发布了 Qwen3.6-27B 和 35B 模型的 CRACK-abliterated 以及 MXFP4/MXFP8 量化版本,保留了 MTP,可在 Apple Silicon 上实现更快的推测解码。
Qwen 3.6 35B A3B 的热度绝非虚名!
作者对小型本地 LLM 进行了基准测试,重点突出了 Qwen 3.6 35B A3B,其将学术代码与研究论文进行映射的能力优于 Gemma 4 和 Nemotron 3 Nano 等模型。