DeepSeek V4.1 Flash 正在令人惊讶地接近 GPT-5.6 Sol 的领域,同时价格低得离谱
摘要
DeepSeek 发布了 V4.1 Flash,一个 552B MoE 模型,具有高效的活动参数,性能接近 GPT-5.6 Sol,而成本却低得多。
DeepSeek 刚刚发布了 V4.1 Flash,一个 552B MoE 模型,输入仅有 8B 活动参数,输出为 16B。
- X 帖子链接:https://x.com/deepseek\_ai/status/2097930608790167907
- Hugging Face 模型页面链接:https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
- 论文链接:https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek\_V41\_Tech\_Report.pdf
相似文章
DeepSeek v4 Flash 能力显著提升
DeepSeek V4 Flash 在预览更新中展现出显著的基准测试提升,在智能体编码任务上与 GPT-5.6 Terra 互有胜负。
新版DeepSeek V4-Flash在ArtificalAnalysis Index上取得50分,比GLM-5.2和GPT-5.6 Luna低1分
DeepSeek的新V4-Flash模型在ArtificalAnalysis Index上得分为50,仅比GLM-5.2和GPT-5.6 Luna低1分。
@TheAhmadOsman:DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,并且还击败了大约一个月前还是 SoTA 模型的 GLM 5.2…
DeepSeek V4 Flash 的体量比 GLM 5.2 小约 70%,但性能却更胜一筹,这意味着达到最先进水平的 AI 可能比预期更早地在 RTX 5090 等消费级硬件上运行。
Deepseek v4.1 Flash 在 OpenDesign Arena 上以 1.4% 的成本达到 Astra 得分的 98%
据 OpenDesign Arena 基准测试报告,DeepSeek V4.1 Flash 以仅 1.4% 的成本达到了 GPT-6 Astra 设计分数的 98%。
DeepSeek R2 刚刚开源,在 12 项基准测试中有 9 项与 GPT-4o 持平——而 API 成本实际为零
DeepSeek R2 是一款全新的开源模型,在十二项基准测试中有九项与 GPT-4o 持平,且可在单块 A100 上完全本地运行,API 成本为零,这可能改变人工智能部署的经济格局。