reasoning-tokens

标签

Cards List
#reasoning-tokens

Qwen 3.8 27B 过度思考:为了击败 Opus 4.6,必须如此

Reddit r/LocalLLaMA · 5天前

本文讨论了 Qwen 3.8 27B,一个拥有 270 亿参数的模型,它通过使用大量推理令牌来与更大的模型竞争,强调了令牌使用的权衡以及本地部署的好处。

0 人收藏 0 人点赞
#reasoning-tokens

不流行观点:Qwen 3.8 27b 不是过度思考者

Reddit r/LocalLLaMA · 6天前

文章认为,Qwen 3.8 27b 增加的推理令牌使用量与其他中国AI模型如 GLM 和 DeepSeek 相似,用户的挫败感源于硬件限制。它建议使用推理预算可以保持性能优于 Qwen 3.6。

0 人收藏 0 人点赞
#reasoning-tokens

潜在推理模型是否易于解释?

Lobsters Hottest · 2026-08-15 缓存

该论文研究了潜在推理模型的可解释性,发现推理令牌通常不是必要的,但在需要时可以被解码以显示可解释的痕迹,表明这些模型实现了预期的解决方案。

0 人收藏 0 人点赞
#reasoning-tokens

Kimi K3的设计秘密可能在其思考痕迹中(6分钟阅读)

TLDR AI · 2026-07-24 缓存

Kimi K3是Moonshot AI最新的开放权重模型,通过使用极端的推理令牌并在其思维链中模拟智能体工作流来迭代设计,从而实现了顶尖性能。

0 人收藏 0 人点赞
#reasoning-tokens

GLM 5.2: 使用不到一半的令牌即可达到最高级别智能的98%

Reddit r/LocalLLaMA · 2026-06-20

GLM 5.2 提供了改进的令牌效率,让用户能够使用不到一半的令牌即可达到最高级别智能的98%。与资源密集型的‘最高’级别相比,模型的‘高’努力级别为日常使用提供了一个实用的替代方案。

0 人收藏 0 人点赞
#reasoning-tokens

ConFu:通过未来思考实现更好的推测采样

arXiv cs.CL · 2026-04-20 缓存

ConFu引入了一个新颖的推测解码框架,使草稿模型能够通过思考令牌和软提示预期未来的生成方向,在多个LLM模型上相比EAGLE-3实现了8-20%的令牌接受率和生成速度提升。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈