qwen3-8

标签

Cards List
#qwen3-8

奇怪的是,没人讨论 Qwen3.8 27b 的温度设置

Reddit r/LocalLLaMA · 18小时前

帖子讨论了 Qwen3.8 27b 的默认温度设置为 1.0,并建议将其设置为 0.7 以减少不必要的推理,同时质疑这对模型能力的影响,以及各种任务的最佳设置。

0 人收藏 0 人点赞
#qwen3-8

Qwen3.8-27B在24GB RTX PRO 4000 SFF上以256K上下文运行(432 GB/s带宽):通过MTP实现每秒50个token

Hacker News Top · 昨天 缓存

本文详细描述了一项实验,该实验在24GB GPU上使用多token预测和自定义优化,实现了Qwen3.8-27B在256K上下文下每秒50个token的推理速度。

0 人收藏 0 人点赞
#qwen3-8

Qwen3.8: 大量思考却无果

Reddit r/LocalLLaMA · 2天前

一位用户对Qwen3.8 27B模型表示不满,批评其过度思考和过度发挥的倾向,这在任务中浪费了时间和上下文,并征求社区对实际使用的反馈。

0 人收藏 0 人点赞
#qwen3-8

这是真的吗?阿里巴巴发布了Qwen3.8,一个2.4T参数的新模型,他们声称其性能仅次于Claude Fable 5。

Reddit r/ArtificialInteligence · 2026-07-19

阿里巴巴发布了Qwen3.8,一个2.4万亿参数的模型,声称性能仅次于Claude Fable 5。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈