@QuixiAI:@Kimi_Moonshot K2.6 在我的 mi300x 上跑出了 56 tps(单请求),接下来做吞吐测试

X AI KOLs Following 模型

摘要

Kimi K2.6 在单张 MI300X GPU 上达到 56 token/s,用户计划进一步测试整体吞吐。

@Kimi_Moonshot K2.6 在我的 mi300x 上跑出了 56 tps(单请求),接下来做吞吐测试
查看原文
查看缓存全文

缓存时间: 2026/04/21 13:02

@Kimi_Moonshot K2.6 在我的 mi300x 上跑,单请求 56 tps。接下来做吞吐量测试

相似文章

Kimi K3 在家用实验室的首批结果 ~ 4t/s

Reddit r/LocalLLaMA

用户分享了在家用实验室运行 Kimi K3 的首批结果,配置为 768GB DDR5 和 2x5090,使用 llama.cpp 分支和 Q2_K 量化,报告预填充速度为 50-70 tps,解码 tps 随时间增长。