@TensordyneInc: 没人能比我们从一兆瓦中获得更多的快速令牌。没人。· 比特精确的对数数学已锁定。· 芯片已完成tape-out…
摘要
Tensordyne宣布其AI推理芯片在TSMC 3nm工艺上完成tape-out,并与HPE Juniper fabric进行系统启动,同时发布了一份关于优化AI推理效率的白皮书。
查看缓存全文
缓存时间: 2026/09/03 18:15
在兆瓦级能耗下实现最优推理速度,我们无人能及。
· 比特级精确对数运算技术已全面锁定。
· 芯片已完成Broadcom合作流片,正由TSMC采用3nm工艺进行晶圆制造。
· 搭载HPE Juniper纵向扩展架构的计算托盘系统启动进度超前。
今日正式发布AI推理核心难题攻克白皮书。
相似文章
Tensordyne 发布对数AI计算芯片:每瓦特令牌数比NVIDIA Blackwell多17倍,吞吐量高13倍。
Tensordyne 宣布了一项突破性推理系统,在硬件中使用对数数学,声称每瓦特令牌数比NVIDIA Blackwell多17倍,吞吐量高13倍,这是通过将对数空间中的复杂乘法替换为简单加法实现的。
@rohanpaul_ai: @TensordyneInc 在推理机架方面取得了重大突破。他们刚刚宣布了一款AI推理机架,声称……
Tensordyne 发布了 Napier AI 推理机架,声称通过使用对数空间数学来降低能耗和晶体管使用量,其吞吐量是 Nvidia NVL72 GB300 的 13 倍,可能颠覆推理硬件格局。
@LambLabs:Lamb Labs(YC S26)正在构建定制AI推理芯片,可实现20,000+ tok/s的速度,且每瓦特智能(Intelligence per Watt)比传统GPU高63倍……
Lamb Labs(YC S26)宣布推出定制AI推理芯片,声称速度可达20,000+ tok/s,且每瓦特智能(Intelligence per Watt)比传统GPU高63倍,并指出GPU之所以被广泛采用是因为其可用性,而非其适用性。
@TensordyneInc: https://x.com/TensordyneInc/status/2066567307984531834
Tensordyne推出了Napier,一种在硅片上使用对数数学的推理系统,声称对MoE和推理模型有巨大的效率提升,并采用风冷机架。
@tenstorrent: 感谢东京!以下是我们在TT-Deploy Japan上宣布的所有内容:更快的AI推理 • Kimi K2.6 900 t/s/u,速度提升3倍…
Tenstorrent在TT-Deploy Japan上宣布,其硬件上对Kimi K2.6、LTX 2.3和DeepSeek-R1实现了更快的AI推理,此外还推出了可授权的TT-Ascalon S RISC-V CPU,用于生成式AI代理应用。