标签
Tenstorrent在TT-Deploy Japan上宣布,其硬件上对Kimi K2.6、LTX 2.3和DeepSeek-R1实现了更快的AI推理,此外还推出了可授权的TT-Ascalon S RISC-V CPU,用于生成式AI代理应用。
高通正通过多起收购积极扩张AI业务,包括收购Modular(Mojo编程语言和MAX推理框架的创建者)以及可能收购Tenstorrent,这表明其正大力挑战Nvidia的CUDA生态系统。
一份关于本地AI硬件在内存容量、带宽和软件栈方面的详细比较,涵盖GPU、Apple Silicon、AMD、Intel、Tenstorrent等,重点关注AI推理中哪些瓶颈最关键。
Steeve Morin 报告通过 ZML 在 Tenstorrent 硬件上运行 Llama 3.1 3B,达到 26 tok/s,接近 Tenstorrent 声称的 33 tok/s。