@Fenng: 看到自媒体写的这么一段儿「最新的第四代 WeLM-80B,总参数已经只有 800 亿了,激活 30 亿,激活率只有 3.75%。作为对比——国内极致成本性能的代表 DeepSeek-V4-Flash,总参数 2840 亿、激活 130 亿…
摘要
Fenng shares a self-media comparison between the fourth-generation WeLM-80B (80B total params, 3B activated, 3.75% activation rate) and DeepSeek-V4-Flash (284B total, 13B activated, 4.6% activation rate), with a humorous comment.
查看缓存全文
缓存时间: 2026/06/23 18:13
看到自媒体写的这么一段儿「最新的第四代 WeLM-80B,总参数已经只有 800 亿了,激活 30 亿,激活率只有 3.75%。作为对比——国内极致成本性能的代表 DeepSeek-V4-Flash,总参数 2840 亿、激活 130 亿,激活率 4.6%。」
😂
且让我伸个脚
相似文章
@Dinosaur_liu: 给全部中美模型厂商说个鬼故事 DeepSeek V4 Flash 只有284b参数 激活参数只有区区13b
据称 DeepSeek V4 Flash 仅有2840亿参数,激活参数仅130亿,对中美模型厂商构成效率冲击。
@FuckAnthropic: 做了对比分析,综合看,DeepSeek V4 Flash-0731 大致是一个 Opus 4.7 - 4.8 之间水平的模型,以极小激活规模进入了前沿 Agent 模型竞争区间,用约 1/12~1/60 的 token 成本进入前沿 Ag…
作者对比分析认为,DeepSeek V4 Flash-0731 在极小激活规模下达到 Opus 4.7-4.8 水平,以极低 token 成本进入前沿 Agent 模型区间,整体超越 GLM-5.2,但短板仍是困难仓库级编程和长时程工程。
DeepSeek-V4 Flash 实际表现如何?
对 DeepSeek-V4 Flash 的性能和能力的评估,评估其实际有效性。
@Saccc_c: 想给deepseek v4 flash增加多模态能力,强烈建议配合qwen3.7-flash使用,目前最高性价比的模型组合 qwen3.7-flash是一个轻量多模态模型,速度快也很适合大部分图片理解任务。关键价格也够低,现在注册有100…
推荐将 DeepSeek v4 flash 与 qwen3.7-flash 组合使用,以低成本为 DeepSeek 增加多模态图片理解能力,并提供了通过阿里云百炼和 Codex 的简单配置步骤。
DeepSeek V4 Flash 0731 智能、性能与价格分析
对 DeepSeek V4 Flash 0731 的分析,涵盖其智能、性能以及与其他 AI 模型的定价对比。