@HuggingModels: 是否曾想过拥有一个结合了Qwen的推理能力、Opus的创造力以及GLM的高效性的模型?欢迎认识Qwen-3.5-Opus-GLM-27B…
摘要
Qwen-3.5-Opus-GLM-27B是一个270亿参数的GGUF合并模型,融合了Qwen的推理能力、Opus的创造力以及GLM的高效性,专为无需云依赖的高性能本地AI设计。
查看缓存全文
缓存时间: 2026/07/10 18:15
你是否曾渴望一款融合了Qwen的推理能力、Opus的创造力以及GLM的高效性的模型?那么,来认识一下Qwen-3.5-Opus-GLM-27B吧——一个拥有270亿参数的GGUF合并模型,正备受AI社区瞩目。它为那些希望摆脱云端依赖、追求顶级性能的用户而打造。https://t.co/Ld9f7hkC2R
相似文章
Qwen3.6-27B-GGUF 重磅发布!
社区 GGUF 版本上线,Qwen 27B 混合架构模型支持 262K 上下文、多模态输入、工具调用,并保留“思考过程”,专为智能体编程而生。
Jackrong/Qwopus-GLM-18B-Merged-GGUF
Jackrong 发布了 Qwopus-GLM-18B-Merged-GGUF,这是一个结合两个 Qwen3.5-9B 微调模型的 64 层“弗兰肯合并”模型,参数规模约 18B。通过 1000 步 LoRA 微调修复了层边界问题。该模型在能力基准测试中达到 90.9%,而显存消耗不到 Qwen 3.6-35B MoE 的一半。
@WaleedAhmad1a10: 查看 Qwen 3.5 27B MoQ 的 GGUF 文件:
Hugging Face 仓库 (kaitchup/Qwen3.6-27B-GGUF-MoQ) 提供了 Qwen3.6-27B MoQ 模型的 GGUF 量化权重,支持使用 llama.cpp 和 Ollama 等工具进行本地推理。
KyleHessling1/Qwopus-GLM-18B-Merged-GGUF
实验性 18B 参数模型:将两个 Qwen-3.5-9B 微调模型堆叠后,用 1000 步 QLoRA“缝合”层边界;生成的 GGUF 在 44 项测试集上超越 Qwen 3.6-35B MoE,却只占 9.2 GB 显存。
@BrianRoemmele: 轰!看看这场开源领域对Anthropic的寒武纪大爆发式反击!来看看Qwythos 9B,一个基于Qwen3.5的GGUF,它…
Qwythos 9B 是一款新的开源、无审查推理模型,基于Qwen3.5,提供GGUF量化版本,拥有100万token上下文、视觉能力和函数调用功能,性能相比基础模型有显著提升。