@TensordyneInc: https://x.com/TensordyneInc/status/2066567307984531834

X AI KOLs Following 产品

摘要

Tensordyne推出了Napier,一种在硅片上使用对数数学的推理系统,声称对MoE和推理模型有巨大的效率提升,并采用风冷机架。

https://t.co/s5e3TQ6E9Z
查看原文
查看缓存全文

缓存时间: 2026/06/16 21:39

AI速度与成本的权衡已正式终结

目前,开发者被迫在超快速推理和实际盈利能力之间做出选择。

我们构建了一个能同时实现这两者的系统。

隆重介绍 Tensordyne Napier——全球首个将对数数学直接嵌入硅片的推理系统。通过从数学底层重新设计AI计算,我们改变了速度和效率的行业标准。

单个 Tensordyne 机架能带来什么:

  • 大规模 2T MoE 模型: 仅需 1 个机架,功耗 120 kW,即可实现每秒 1000 token 的处理速度(而传统基础设施需要 9–14 个机架,功耗高达 1.5 MW)。
  • 下一代推理(DeepSeek-R1): 相比 Nvidia NVL72 GB300,可提供 13 倍以上的每秒 token 数17 倍以上的每兆瓦 token 数
  • 无缝部署: 提供 608 PFLOPS 的 FP8 算力,同时保持 100% 风冷。可直接放入现有标准机架,无需改造数据中心。
  • 核心收益: 相比传统方案,单个机架每年可多创造高达 3300 万美元的营收。

快速且低成本的AI已经到来。

我们正在加速生产,预计年底前实现量产。

更多信息请访问 www.tensordyne.ai

2:13

相似文章

进展(3分钟阅读)

TLDR AI

Etched宣布在低电压推理和集群规模内存方面取得突破,应用于其AI推理硬件,首批机架将于今年夏季发货,并拥有10亿美元的客户合同。

nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-BF16 · Hugging Face

Reddit r/LocalLLaMA

NVIDIA 发布了 Nemotron-Labs-3-Puzzle-75B-A9B,这是一种从 Nemotron-3-Super 衍生而来的压缩混合 MoE 大型语言模型,实现了约 2 倍更高的服务器吞吐量和更高的并发性,同时在推理、编码和长上下文基准测试中保持强劲的准确度。