qwen-3

标签

Cards List
#qwen-3

GPT-6.1 Sol 成本低廉。我们通过禁止它编写代码将其成本降低了77%

Reddit r/AI_Agents ↗ · 23小时前

一项实际测试表明,在AI代理设置中,将GPT-6.1 Sol作为无写入权限的协调器,Qwen 3.8 27B作为工作器,可将成本降低77%,但会增加小任务的执行时间。

0 人收藏 0 人点赞
#qwen-3

Qwen 3.8 Next Engram 用途是什么?

Reddit r/LocalLLaMA ↗ · 2026-08-28

本文探讨了 Qwen 3.8 Next AI 模型中的 Engram 组件,详细描述其为一个具有高度偏斜访问模式的 510 亿参数 Zipfian 缓存,并评估了通过频率剪枝进行压缩的优化方法。

0 人收藏 0 人点赞
#qwen-3

我们量化了 Qwen 3.8 27B 并在 RTX 6000 上比较了量化版本

Reddit r/LocalLLaMA ↗ · 2026-08-23

团队将 Qwen 3.8 27B 量化为多种 GGUF 格式,并在 RTX 6000 上进行了基准测试,发现不同量化版本性能相似,推荐 AD-Q6_K 以保证安全性。

0 人收藏 0 人点赞
#qwen-3

Claude Sonnet 4.6 在预测未来 qwen 3.8 27b 性能方面表现出色

Reddit r/LocalLLaMA ↗ · 2026-08-20

一位用户分享了Claude 3.5 Sonnet如何基于早期模型差异进行外推,准确预测了Qwen 3.8 27B的未来性能,基准测试结果非常接近。

0 人收藏 0 人点赞
#qwen-3

100%本地模型,就在你的智能手机上!

Reddit r/artificial ↗ · 2026-07-05

一位开发者分享了成功微调Qwen 3模型(1.5B和4B)用于智能手机本地使用的经验,附带可下载的离线APK,并计划推出Windows版本。

0 人收藏 0 人点赞
#qwen-3

一个纯C从头编写的、仅支持CPU的Qwen 3精简推理引擎

Reddit r/LocalLLaMA ↗ · 2026-06-28

一个纯C从头实现的、仅支持CPU的Qwen 3模型最小推理引擎

0 人收藏 0 人点赞
#qwen-3

@zhixianio: 试完了,感觉还挺大跌眼镜的,不知道是不是我打开的方式不对,欢迎大家给出反例。接下来是我测的结果: 在 M5 Max 上,拿这个社区微调版 gemma-4-12B-coder (llama.cpp)对打我日常在用的 Qwen3.6-35B-…

X AI KOLs Timeline ↗ · 2026-06-15 缓存

用户测试了社区微调版 gemma-4-12B-coder 与 Qwen3.6-35B-A3B MoE 在三个编程任务上的表现,发现 gemma 在复杂有状态程序上表现不佳,而 Qwen 35B 依然稳健。

0 人收藏 0 人点赞
#qwen-3

Gemma 4 31B 的能力让我惊讶

Reddit r/LocalLLaMA ↗ · 2026-06-09

一位用户分享了轶事发现:Gemma 4 31B 在理解和重构杂乱的学术代码方面优于 Qwen 3.6 模型,并与 Opus 4.7 能力相当,还突出了一个 Gemma 擅长的基准测试(SciCode)。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈