@TheAhmadOsman:DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,并且还击败了大约一个月前还是 SoTA 模型的 GLM 5.2…

X AI KOLs Following 模型

摘要

DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,但性能却更胜一筹,这意味着达到最先进水平的 AI 可能比预期更早地在 RTX 5090 等消费级硬件上运行。

DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70% 它同时还击败了大约一个月前还是 SoTA 模型的 GLM 5.2 在这个视频中,我解释了我们将如何在不到 18 个月内在单块 RTX 5090 上获得 GLM 5.2 级别的智能 看起来这比那要快得多 https://t.co/2acikb4rEA
查看原文
查看缓存全文

缓存时间: 2026/07/31 14:51

DeepSeek V4 Flash 的体积比 GLM 5.2 小约 70%

它还超越了 GLM 5.2——就在大约一个月前,GLM 5.2 还是 SOTA 模型

在这个视频中,我解释了我们将如何在不到 18 个月的时间内,在单张 RTX 5090 上获得 GLM 5.2 级别的智能

看来这一天会比预期来得更快 https://t.co/2acikb4rEA

Ahmad (@TheAhmadOsman): 预测

从现在起不到 18 个月,我们将在单张 RTX PRO 6000 上运行 Kimi K3 同等级别的智能

相似文章

Deepseek V4 Flash 在 RTX 5090 MoE 上运行

Reddit r/LocalLLaMA

用户分享了在 RTX 5090 上使用 llama.cpp 的一个分支运行 DeepSeek-V4-Flash (Q2_K) 的优化基准测试结果,实现了 21.3 token/秒的生成速度和 100 万上下文大小。

DeepSeek v4 Flash 能力显著提升

Reddit r/LocalLLaMA

DeepSeek V4 Flash 在预览更新中展现出显著的基准测试提升,在智能体编码任务上与 GPT-5.6 Terra 互有胜负。