@EMostaque:我认为@deepseek_ai v4.1 Flash的训练成本约为1000万美元,比GPT-6 Astra低100倍。运行成本也低100倍……
摘要
一条推文估计,DeepSeek AI的v4.1 Flash模型训练成本为1000万美元,比GPT-6 Astra低100倍,运行成本更低,且基准测试性能相似,这引发了关于前沿AI实验室牛市案例的质疑。
查看缓存全文
缓存时间: 2026/09/16 09:58
所以 @deepseek_ai v4.1 Flash 我估计训练成本约为1000万美元,比 GPT-6 Astra 低100倍。
其运行成本也低100倍,而在日常设计和其他基准测试中得分相近。
一旦开源模型足够成熟,前沿AI实验室的利好论点是什么?https://t.co/0qi59qioI4
相似文章
研究公司称,DeepSeek的新AI模型是迄今为止知名模型中运行成本最低的(4分钟阅读)
据报道,DeepSeek的新V4-Flash AI模型是已知模型中运行成本最低的,其成本比Anthropic的Claude Fable 5低105倍。
一旦计入重试次数,更便宜的AI模型未必更便宜
一项并排编码实验对比了GPT-5.6 Luna与DeepSeek V4 Flash,结果显示,在计入重试后,DeepSeek看似5倍的价格优势大幅缩水。文章主张采用更全面的基准测试,报告每次尝试的成本和每次验证成功的成本。
DeepSeek R2 刚刚开源,在 12 项基准测试中有 9 项与 GPT-4o 持平——而 API 成本实际为零
DeepSeek R2 是一款全新的开源模型,在十二项基准测试中有九项与 GPT-4o 持平,且可在单块 A100 上完全本地运行,API 成本为零,这可能改变人工智能部署的经济格局。
Deepseek v4.1 Flash 在 OpenDesign Arena 上以 1.4% 的成本达到 Astra 得分的 98%
据 OpenDesign Arena 基准测试报告,DeepSeek V4.1 Flash 以仅 1.4% 的成本达到了 GPT-6 Astra 设计分数的 98%。
@cyrilXBT:中国刚刚打造了一款AI模型,以极低成本与OpenAI和Anthropic正面竞争。而且有人刚刚发布了一门免费课程……
DeepSeek是一款由中国量化对冲基金开发的AI模型,据报道其训练成本仅为GPT-4的约5%,却能达到相当的性能水平,引发了市场剧烈震荡,导致NVIDIA单日市值蒸发6000亿美元。目前已有人发布了一门时长1小时50分钟的免费课程,教用户如何在本地及通过API使用DeepSeek V4。