标签
这是一个社区微调并合并的Qwen 3.5 9B版本,声称在关键基准测试中超越更大模型,支持多token预测,以GGUF格式提供。
DavidAU 发布了 Qwen3.6-27B-Fable-Fusion-711,这是一个对 Qwen 3.6 27B 进行多阶段微调的模型,声称在 ARC-C 基准测试中超过 700 分,超越了基础模型并匹敌闭源模型,提供 GGUF 格式,适用于消费级硬件。
Krea 2 Raw 的社区微调版本,支持基于指令的身份保留图像编辑。它能在编辑图像的同时保留脸部等细节,并使用自定义的 ComfyUI 节点包。
Grug-35B-A3B 是一个基于 Qwen-3.6-35B-A3B 的开源实验模型,可将推理 token 使用量减少约 69.8%,同时将答案质量维持在基础模型的 2% 以内,从而实现更快的生成速度和更少的上下文使用。
针对代码任务的 Gemma 4 12B 专注微调版本,从思维链数据(Composer 2.5 和 Fable 5)中蒸馏而来,并量化为 GGUF 格式,以在本地离线使用,仅需极低 VRAM 要求
Super Gemma 4 26B Uncensored GGUF v2 是一个社区微调模型,提供无审查的回复,零拒绝,改进的速度,修复了工具调用,针对 llama.cpp 和 vLLM 上的本地推理进行了优化。
H Company发布Holo3.1,这是一个面向计算机使用代理的视觉语言模型系列(0.8B至35B),支持Web、桌面和移动端自动化,具备原生函数调用功能,并提供优化后的量化检查点,便于本地部署。
MiniMax M2.7 模型已微调为无审查变体 'ultra uncensored heretic',拒绝率极低(4/100)。在HuggingFace上提供Safetensors和GGUF格式。
Dramabox 是 Resemble AI 开发的一个富有表现力的文本转语音模型,通过提示驱动控制来实现说话人身份、情感和表达方式,并可选地使用 10 秒参考音频进行声音克隆。该模型基于 LTX-2.3 音频扩散变换器构建,已在 Hugging Face 上开源。