@YRSM_Simon: 别被 Max 这名字“骗”了。 同一个任务我测试了100遍。 deepseek v4 flash max 比 medium 快 26%,token 省 34%,质量评分高83%。 max 虽然想得多,但是轮数也会更少。 (每个任务都不一样…

X AI KOLs Following 新闻

摘要

作者对同一任务测试了100遍,发现DeepSeek V4 Flash Max比Medium版本快26%、节省34% token,且质量评分高83%;Max虽思考更多但轮数更少。

别被 Max 这名字“骗”了。 同一个任务我测试了100遍。 deepseek v4 flash max 比 medium 快 26%,token 省 34%,质量评分高83%。 max 虽然想得多,但是轮数也会更少。 (每个任务都不一样的,具体配置需要自行测试) https://t.co/ALj5llIOf6
查看原文
查看缓存全文

缓存时间: 2026/08/14 09:36

别被 Max 这名字“骗”了。

同一个任务我测试了100遍。

deepseek v4 flash max 比 medium 快 26%,token 省 34%,质量评分高83%。

max 虽然想得多,但是轮数也会更少。

(每个任务都不一样的,具体配置需要自行测试) https://t.co/ALj5llIOf6

相似文章

@FuckAnthropic: 做了对比分析,综合看,DeepSeek V4 Flash-0731 大致是一个 Opus 4.7 - 4.8 之间水平的模型,以极小激活规模进入了前沿 Agent 模型竞争区间,用约 1/12~1/60 的 token 成本进入前沿 Ag…

X AI KOLs Timeline

作者对比分析认为,DeepSeek V4 Flash-0731 在极小激活规模下达到 Opus 4.7-4.8 水平,以极低 token 成本进入前沿 Agent 模型区间,整体超越 GLM-5.2,但短板仍是困难仓库级编程和长时程工程。