@ggerganov:llama-server -hf ggml-org/Qwen3.6-27B-GGUF --spec-default

X AI KOLs Following 工具

摘要

Georgi Gerganov 分享了一条一行命令,用 llama-server 以默认投机解码设置启动量化版 27B Qwen3.6 模型。

llama-server -hf ggml-org/Qwen3.6-27B-GGUF --spec-default
查看原文
查看缓存全文

缓存时间: 2026/04/22 17:02

llama-server -hf ggml-org/Qwen3.6-27B-GGUF –spec-default

相似文章

Qwen3.6 27B 在 vLLM 中的表现比在 llama.cpp 中更差

Reddit r/LocalLLaMA

一名用户报告称,Qwen3.6-27B 模型在使用 llama.cpp 时比使用 vLLM 表现更好且更可靠,并指出尽管进行了大量配置,vLLM 仍出现工具调用错误和“被切除脑叶”的行为。