标签
该文章宣布了 Qwen3.8-Flash-Next 在 MLX-serve 上的发布,支持 100 万 token 上下文,并在 M5 Max 硬件上使用量化权重实现了高效性能。
用户报告了Qwen3.8-Flash-Next的问题,例如多轮对话跟踪能力差,与性能更好的Qwen3.8-27B相比。