Antirez 在 HF 上发布 Deepseek 4.1 flash gguf 模型

Reddit r/LocalLLaMA 模型

摘要

Antirez 已将 Deepseek 4.1 flash 模型的量化 gguf 版本上传至 Hugging Face,部分可用,并有关于使用方法的疑问。

Q2 已经上传,Q4 正在我输入时上传中。他的 GitHub 是否已更新?如何运行这个?https://huggingface.co/antirez/deepseek-v4.1-flash-gguf/tree/main
查看原文

相似文章

Deepseek V4 Flash 2位、3位和4位 GGUFs

Reddit r/LocalLLaMA

DeepSeek V4 Flash 的 2位、3位和4位精度 GGUF 量化版本,已在 Hugging Face 上发布,可用于 llama.cpp 和 Ollama 等工具的本地推理。

antirez/deepseek-v4-gguf

Hugging Face Models Trending

Antirez发布了专门为DS4推理引擎优化的DeepSeek V4 Flash GGUF量化版本,针对不同内存大小提供了优化配置,使得这个大型MoE模型可以在本地运行。

Bartowski 已发布 DS4 GGUF

Reddit r/LocalLLaMA

Bartowski 发布了 DeepSeek-V4-Flash 的 GGUF 量化版本,并邀请用户与 Antirez 的版本进行对比。

huihui-ai/Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF

Hugging Face Models Trending

这是 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF 的模型卡,它是 DeepSeek-V4-Flash 的 abliterated(无审查)GGUF 量化变体,专为与 llama.cpp 和 ds4 一起本地使用而设计。