Antirez 在 HF 上发布 Deepseek 4.1 flash gguf 模型
摘要
Antirez 已将 Deepseek 4.1 flash 模型的量化 gguf 版本上传至 Hugging Face,部分可用,并有关于使用方法的疑问。
Q2 已经上传,Q4 正在我输入时上传中。他的 GitHub 是否已更新?如何运行这个?https://huggingface.co/antirez/deepseek-v4.1-flash-gguf/tree/main
相似文章
Deepseek V4 Flash 2位、3位和4位 GGUFs
DeepSeek V4 Flash 的 2位、3位和4位精度 GGUF 量化版本,已在 Hugging Face 上发布,可用于 llama.cpp 和 Ollama 等工具的本地推理。
antirez/deepseek-v4-gguf
Antirez发布了专门为DS4推理引擎优化的DeepSeek V4 Flash GGUF量化版本,针对不同内存大小提供了优化配置,使得这个大型MoE模型可以在本地运行。
Bartowski 已发布 DS4 GGUF
Bartowski 发布了 DeepSeek-V4-Flash 的 GGUF 量化版本,并邀请用户与 Antirez 的版本进行对比。
unsloth/DeepSeek-V4-Flash-0731-GGUF
Unsloth 预告了即将在 Hugging Face 上发布的 DeepSeek V4 Flash GGUF 量化模型。
huihui-ai/Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
这是 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF 的模型卡,它是 DeepSeek-V4-Flash 的 abliterated(无审查)GGUF 量化变体,专为与 llama.cpp 和 ds4 一起本地使用而设计。