@TheAhmadOsman: 顺便说一下,DeepSeek V4 Flash 0731 击败了 Qwen 3.8 27B
摘要
Ahmad 在推特上表示 DeepSeek V4 Flash 0731 性能优于 Qwen 3.8 27B,并列举了其他模型如 Kimi K3、GLM 5.2 和 MiniMax H3。
查看缓存全文
缓存时间: 2026/08/21 09:15
确实,DeepSeek V4 Flash 0731 性能超越了 Qwen 3.8 27B。
Ahmad (@TheAhmadOsman):
提到的模型包括 Kimi K3、GLM 5.2、DeepSeek V4 Flash 0731 以及 MiniMax H3。
相似文章
Qwen3.8-Max 媲美 Kimi K3 和 DeepSeek V4 Flash
Qwen3.8-Max 是一款 2.4T 参数的开源权重模型,在基准测试中与 Kimi K3 和 DeepSeek V4 Flash 表现持平,在编码和软件任务上尤为出色。权重将于下周发布,定价为输入 $2/百万 tokens、输出 $6/百万 tokens。
Qwen 3.8 27b 对比 Deepseek Flash
这篇文章对比了开源AI模型Qwen 3.8 (27B) 和 Deepseek Flash,讨论了基准测试,并寻求用户经验以评估它们的性能。
Deepseek V4 Flash 现已成为仅次于 Kimi K3 的第二大开源权重模型,且成本低 50 倍以上
DeepSeek 的新 V4 Flash 模型据报道是仅次于 Kimi K3 的第二大开源权重模型,以超过 50 倍更低的成本(每 100 万 tokens 0.09/0.18 美元)提供强劲性能,并具备扎实的代码和推理能力。
DeepSeek v4 Flash 对比 Qwen3.6-27B、Qwen3.5-122B 和 Gemma 4 31B 基准测试
用户在本地编码基准测试中对 DeepSeek v4 Flash 与 Qwen3.6-27B、Qwen3.5-122B 和 Gemma 4 31B 进行了对比,发现 Flash 总体胜出,但 Qwen 122B 表现惊人,首次尝试成功率更高且 token 消耗更低。
我们实测了DeepSeek V4 Pro和Flash与Claude Opus 4.7和Kimi K2.6的对比(11分钟阅读)
DeepSeek于2026年4月24日以MIT许可证发布了V4 Pro和V4 Flash。在与Claude Opus 4.7和Kimi K2.6的基准测试中,V4 Pro得分77/100,价格为2.25美元,性能介于Opus 4.7(91分)和Kimi K2.6(68分)之间;而V4 Flash得分60/100,价格为0.02美元,是本次对比中最便宜的,并且到5月31日前购买V4 Pro可享受75%的折扣。