@QuixiAI: 我的经验是,Qwen3.8-Flash-Next甚至无法跟踪多轮对话。它回答的是之前的问题……

X AI KOLs Timeline 模型

摘要

用户报告了Qwen3.8-Flash-Next的问题,例如多轮对话跟踪能力差,与性能更好的Qwen3.8-27B相比。

我的经验是,Qwen3.8-Flash-Next甚至无法跟踪多轮对话。它回答的是我两轮前提出的问题。 这发生在FP8 https://t.co/tK8QrGRvnh
查看原文
查看缓存全文

缓存时间: 2026/08/29 06:03

我使用 Qwen3.8-Flash-Next 的体验是,它甚至无法正确追踪多轮对话。它会回答我两轮前提出的问题。 这是在 FP8 精度下运行的结果 https://t.co/tK8QrGRvnh

David Hendrickson (@TeksEdge): 在我的测试中,Qwen3.8-Flash-Next 的表现真的很差。☹️ Qwen3.8-27B(以积极的方式)秒杀了我的 Cosmic Dodge 游戏——一次就通过了,第二次运行则让它更加完善。而 Qwen3.8-Flash-Next 则非常挣扎。在五次尝试中,它都没有完全正确。Boss 不会死,……

相似文章

Qwen3.8-Flash-Next-NVFP4 对比 Qwen3.8-27B-FP 测试结果

Reddit r/LocalLLaMA

本文详细测试了Qwen3.8-Flash-Next-NVFP4与Qwen3.8-27B-FP8两款AI模型在各类任务中的性能表现,结果显示Flash-Next版本在速度与失败率方面更具优势,但在处理多步骤符号任务时表现较弱。

Qwen/Qwen3.8-Flash-Next

Hugging Face Models Trending

发布 Qwen3.8-Flash-Next,一款开放权重的 AI 模型,引入混合注意力(Hybrid Attention)与 QSA 以及门控残差(Gated Residual)等架构创新,提升效率和可扩展性,预览未来的 Qwen4 架构。

Qwen3.8-Flash-Next

Simon Willison's Blog

Qwen 发布了 Qwen3.8-Flash-Next,这是一款开放权重的多模态 MoE 模型,拥有 125B tokens,但只有 6B 活跃参数,提供了性能提升,并作为 Qwen4 架构的早期预览。