@EMostaque:我认为@deepseek_ai v4.1 Flash的训练成本约为1000万美元,比GPT-6 Astra低100倍。运行成本也低100倍……

X AI KOLs Following 模型

摘要

一条推文估计,DeepSeek AI的v4.1 Flash模型训练成本为1000万美元,比GPT-6 Astra低100倍,运行成本更低,且基准测试性能相似,这引发了关于前沿AI实验室牛市案例的质疑。

我认为@deepseek_ai v4.1 Flash的训练成本约为1000万美元,比GPT-6 Astra低100倍。 运行成本也低100倍,并且在日常设计和其他基准测试中得分大致相同。 一旦开源模型足够胜任,前沿AI实验室的牛市案例是什么? https://t.co/0qi59qioI4
查看原文
查看缓存全文

缓存时间: 2026/09/16 09:58

所以 @deepseek_ai v4.1 Flash 我估计训练成本约为1000万美元,比 GPT-6 Astra 低100倍。

其运行成本也低100倍,而在日常设计和其他基准测试中得分相近。

一旦开源模型足够成熟,前沿AI实验室的利好论点是什么?https://t.co/0qi59qioI4

相似文章

一旦计入重试次数,更便宜的AI模型未必更便宜

Reddit r/artificial

一项并排编码实验对比了GPT-5.6 Luna与DeepSeek V4 Flash,结果显示,在计入重试后,DeepSeek看似5倍的价格优势大幅缩水。文章主张采用更全面的基准测试,报告每次尝试的成本和每次验证成功的成本。

@cyrilXBT:中国刚刚打造了一款AI模型,以极低成本与OpenAI和Anthropic正面竞争。而且有人刚刚发布了一门免费课程……

X AI KOLs Timeline

DeepSeek是一款由中国量化对冲基金开发的AI模型,据报道其训练成本仅为GPT-4的约5%,却能达到相当的性能水平,引发了市场剧烈震荡,导致NVIDIA单日市值蒸发6000亿美元。目前已有人发布了一门时长1小时50分钟的免费课程,教用户如何在本地及通过API使用DeepSeek V4。