@Dinosaur_liu: 给全部中美模型厂商说个鬼故事 DeepSeek V4 Flash 只有284b参数 激活参数只有区区13b
摘要
据称 DeepSeek V4 Flash 仅有2840亿参数,激活参数仅130亿,对中美模型厂商构成效率冲击。
查看缓存全文
缓存时间: 2026/08/03 09:38
给全部中美模型厂商说个鬼故事
DeepSeek V4 Flash 只有284b参数
激活参数只有区区13b https://t.co/xGWUEQH1Qc
相似文章
@Fenng: 看到自媒体写的这么一段儿「最新的第四代 WeLM-80B,总参数已经只有 800 亿了,激活 30 亿,激活率只有 3.75%。作为对比——国内极致成本性能的代表 DeepSeek-V4-Flash,总参数 2840 亿、激活 130 亿…
Fenng shares a self-media comparison between the fourth-generation WeLM-80B (80B total params, 3B activated, 3.75% activation rate) and DeepSeek-V4-Flash (284B total, 13B activated, 4.6% activation rate), with a humorous comment.
@geekbb: 看了一下,这个图片 DeepSeek V4 Flash 价格往前移,又可以活一大片呢。风水轮流转,今天该大模型厂商叫梁圣了
作者评论DeepSeek V4 Flash降价,认为这能让更多厂商活下去,并调侃称大模型厂商该叫梁文峰为“梁圣”。
@FuckAnthropic: 做了对比分析,综合看,DeepSeek V4 Flash-0731 大致是一个 Opus 4.7 - 4.8 之间水平的模型,以极小激活规模进入了前沿 Agent 模型竞争区间,用约 1/12~1/60 的 token 成本进入前沿 Ag…
作者对比分析认为,DeepSeek V4 Flash-0731 在极小激活规模下达到 Opus 4.7-4.8 水平,以极低 token 成本进入前沿 Agent 模型区间,整体超越 GLM-5.2,但短板仍是困难仓库级编程和长时程工程。
@Saccc_c: 想给deepseek v4 flash增加多模态能力,强烈建议配合qwen3.7-flash使用,目前最高性价比的模型组合 qwen3.7-flash是一个轻量多模态模型,速度快也很适合大部分图片理解任务。关键价格也够低,现在注册有100…
推荐将 DeepSeek v4 flash 与 qwen3.7-flash 组合使用,以低成本为 DeepSeek 增加多模态图片理解能力,并提供了通过阿里云百炼和 Codex 的简单配置步骤。
DeepSeek-V4-Flash-0731
DeepSeek 宣布推出 DeepSeek-V4-Flash-0731,这是一款以 Flash 级别定价提供先进能力的前沿智能体模型。