@scaling01: DeepSeek 刚刚将其推理成本降低约5倍,吞吐量达50 TPS
摘要
DeepSeek 已将推理成本降低约5倍,同时保持每秒50个token的吞吐量。
DeepSeek 刚刚将其推理成本降低了约5倍,同时吞吐量达到50 TPS https://t.co/9lYUGsshdb
查看缓存全文
缓存时间: 2026/06/29 02:26
DeepSeek 刚刚将其推理成本降低约5倍,速度达到50 TPS https://t.co/9lYUGsshdb
Lisan al Gaib (@scaling01): 怎么能不喜欢 DeepSeek 呢
感谢文峰大人继续让智能变得便宜到无法计量
相似文章
@rohanpaul_ai: NVIDIA最新发布的报告称其Blackwell推理栈在一个月内将DeepSeek V4的token成本降低了多达5倍。
NVIDIA报告称其Blackwell推理栈在一个月内将DeepSeek V4的token成本降低了多达5倍。
研究公司称,DeepSeek的新AI模型是迄今为止知名模型中运行成本最低的(4分钟阅读)
据报道,DeepSeek的新V4-Flash AI模型是已知模型中运行成本最低的,其成本比Anthropic的Claude Fable 5低105倍。
)
DeepSeek发布了其新的V4-Pro-0813模型,每百万输出tokens定价0.87美元,同时声称在基准测试中表现出色,可与Anthropic的Opus 4.8相媲美,并加剧了与OpenAI的人工智能价格战。
DeepSeek 宣布促销期后将永久降价75%
DeepSeek 宣布在促销期结束后将永久降价75%,使其AI服务对用户来说价格大幅降低。
@cline:虽然DeepSeek V4-Flash在每token价格上便宜得多,但这可能具有误导性,如果每项任务的总成本……
讨论了DeepSeek V4-Flash的每token价格与每项任务总成本的对比,引用了一份报告,称DeepSeek完成基准测试任务的成本比Fable低105倍。