需要 DeepSeek V3.2 各量化级别的质量基准信息 [D]

Reddit r/MachineLearning 工具

摘要

开发者寻求质量基准,以评估运行时量化对 DeepSeek V3.2 模型性能的影响。

我正在调研一款能在运行时对 DeepSeek V3.2 做量化的产品,想衡量相比无量化时的质量损失。可以跑哪些基准测试?
查看原文

相似文章

Qwen 3.8 27b 对比 Deepseek Flash

Reddit r/LocalLLaMA

这篇文章对比了开源AI模型Qwen 3.8 (27B) 和 Deepseek Flash,讨论了基准测试,并寻求用户经验以评估它们的性能。

DeepSeek-V3 技术报告

Papers with Code Trending

DeepSeek-V3 是一个参数高效的混合专家(MoE)语言模型,总参数为 671B,在训练仅需 2.788M H800 GPU 小时的情况下,实现了与领先闭源模型相当的性能。