@Saccc_c: Deepseek v4 flash 和 Qwen 3.8 max 压力这么大的吗? GLM 官网显示 GLM-5.3上线了
摘要
推文提到 GLM 官网已上线 GLM-5.3,并感叹 Deepseek v4 flash 和 Qwen 3.8 max 面临的压力很大。
Deepseek v4 flash 和 Qwen 3.8 max 压力这么大的吗?
GLM 官网显示 GLM-5.3上线了 https://t.co/5GcfIFnDaL
查看缓存全文
缓存时间: 2026/08/03 09:39
Deepseek v4 flash 和 Qwen 3.8 max 压力这么大的吗?
GLM 官网显示 GLM-5.3上线了 https://t.co/5GcfIFnDaL
相似文章
@Saccc_c: 想给deepseek v4 flash增加多模态能力,强烈建议配合qwen3.7-flash使用,目前最高性价比的模型组合 qwen3.7-flash是一个轻量多模态模型,速度快也很适合大部分图片理解任务。关键价格也够低,现在注册有100…
推荐将 DeepSeek v4 flash 与 qwen3.7-flash 组合使用,以低成本为 DeepSeek 增加多模态图片理解能力,并提供了通过阿里云百炼和 Codex 的简单配置步骤。
@zhixianio: 试完了,感觉还挺大跌眼镜的,不知道是不是我打开的方式不对,欢迎大家给出反例。接下来是我测的结果: 在 M5 Max 上,拿这个社区微调版 gemma-4-12B-coder (llama.cpp)对打我日常在用的 Qwen3.6-35B-…
用户测试了社区微调版 gemma-4-12B-coder 与 Qwen3.6-35B-A3B MoE 在三个编程任务上的表现,发现 gemma 在复杂有状态程序上表现不佳,而 Qwen 35B 依然稳健。
@TheAhmadOsman:DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,并且还击败了大约一个月前还是 SoTA 模型的 GLM 5.2…
DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,但性能却更胜一筹,这意味着达到最先进水平的 AI 可能比预期更早地在 RTX 5090 等消费级硬件上运行。
Qwen3.8-Max 媲美 Kimi K3 和 DeepSeek V4 Flash
Qwen3.8-Max 是一款 2.4T 参数的开源权重模型,在基准测试中与 Kimi K3 和 DeepSeek V4 Flash 表现持平,在编码和软件任务上尤为出色。权重将于下周发布,定价为输入 $2/百万 tokens、输出 $6/百万 tokens。
@wquguru: https://x.com/wquguru/status/2057852569054278045
对 pi-goal 工具进行源码解析和多模型实测,发现 DeepSeek V4 Pro 在长程任务上比 Gemini 3.5 Flash 便宜 31 倍且质量更高,且更高思考模式反而导致幻觉增加。