只是我一个人觉得 Qwen3.8-Flash-Next 真的很不稳定吗?

Reddit r/LocalLLaMA 新闻

摘要

有用户反映在 Mac 上使用 Qwen3.8-Flash-Next 模型时,遇到了模型幻觉和推理异常的问题,同时报告了 AppImage 安装问题以及从 HuggingFace 拉取张量元数据时的异常,尽管量化程度已经很高。

我是说,这明明是在 Mac 上,为什么会安装一个八年前的 Ubuntu AppImage 并且出现幻觉安装的情况... 而且这条消息是在从 HuggingFace 拉取张量元数据的过程中出现的。之前根本没听说过 OpenD 这东西... 完全是凭空捏造的内容。而且这还不是低量化——这是 5bpw 量化,张量最低也只有 Q4。编辑:我不是在找解决方案 -> 我是真的在问,有没有其他人也注意到这种幻觉和奇怪的推理现象。
查看原文

相似文章

Qwen3.8-Flash-Next 针对 Mac 优化版

Reddit r/LocalLLaMA

本文详细介绍了在 Mac M1 Max 硬件上运行 Qwen3.8-Flash-Next AI 模型的自定义优化,包括 SSD 流、自定义量化和稀疏注意力机制,以提升性能。

orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF

Hugging Face Models Trending

本文发布未经审查的 Qwen3.8-Flash-Next 模型的 GGUF 量化版本,这是 Qwen4 架构的混合专家模型预览版,专为支持视觉功能的 llama.cpp 设计,需要自定义构建以确保兼容性。