标签
帖子讨论了 Qwen3.8 27b 的默认温度设置为 1.0,并建议将其设置为 0.7 以减少不必要的推理,同时质疑这对模型能力的影响,以及各种任务的最佳设置。
本文详细描述了一项实验,该实验在24GB GPU上使用多token预测和自定义优化,实现了Qwen3.8-27B在256K上下文下每秒50个token的推理速度。
一位用户对Qwen3.8 27B模型表示不满,批评其过度思考和过度发挥的倾向,这在任务中浪费了时间和上下文,并征求社区对实际使用的反馈。
阿里巴巴发布了Qwen3.8,一个2.4万亿参数的模型,声称性能仅次于Claude Fable 5。