@xueyu1125: 想跑本地大模型,如果能达到 50 token/s,才比较可用 提供下顶尖模型 API 输出速度参考(Gemini Flash 300+) DeepSeek V4 Flash:99.5 token/s GPT-5.6 Sol:68.1 to…

X AI KOLs Following 新闻

摘要

讨论本地大模型运行所需的token速度标准,并提供了多个顶级AI模型的API输出速度对比。

想跑本地大模型,如果能达到 50 token/s,才比较可用🤣 提供下顶尖模型 API 输出速度参考(Gemini Flash 300+) DeepSeek V4 Flash:99.5 token/s GPT-5.6 Sol:68.1 token/s Grok 4.6:56.5 token/s Claude Opus 4.8 Anthropic:54.4 token/s https://t.co/WY50yLUEuz
查看原文
查看缓存全文

缓存时间: 2026/08/18 18:37

想跑本地大模型,如果能达到 50 token/s,才比较可用🤣

提供下顶尖模型 API 输出速度参考(Gemini Flash 300+) DeepSeek V4 Flash:99.5 token/s GPT-5.6 Sol:68.1 token/s Grok 4.6:56.5 token/s Claude Opus 4.8 Anthropic:54.4 token/s https://t.co/WY50yLUEuz

相似文章