台湾公司Skymizer发布HTX301 - 配备384GB内存、功耗约240瓦的PCIE推理卡
摘要
Skymizer发布HTX301,一款能够本地运行700B参数大语言模型、拥有高内存和低功耗的PCIE推理卡。
暂无内容
查看缓存全文
缓存时间: 2026/05/08 10:03
# Skymizer 发布 HTX301 — 重塑本地 AI 推理
来源:https://skymizer.ai/skymizer-announces-htx301-reinventing-on-prem-ai-inference/
跳转到内容 (https://skymizer.ai/skymizer-announces-htx301-reinventing-on-prem-ai-inference/#content)
- 分类 (https://skymizer.ai/skymizer-announces-htx301-reinventing-on-prem-ai-inference/#)
## Skymizer 发布 HTX301 — 重塑本地 AI 推理
**Skymizer 今日宣布推出 HTX301**,这是基于 HyperThought™ 平台构建的首款参考芯片,重新定义了企业部署和扩展 AI 推理的方式。
首次实现**超大规模模型可在单一 PCIe 卡上运行**。凭借**六颗 HTX301 芯片和 384GB 内存**,企业现在能够**以仅约 240W 的功耗在本地执行 7000 亿参数的大语言模型推理**——无需庞大的 GPU 集群、NVLink/NVSwitch 互联以及复杂的冷却基础设施。
为推理主导型 AI 新时代而生,HyperThought™ 引入了一种根本不同的方法。通过**将预填充和解码工作负载分离**,并搭配**解码优先芯片**与智能软件编排栈,HTX301 在实际部署中实现了**更高的利用率、更低的延迟以及显著提升的能效**。
*HyperThought™* 在统一架构下,借助 LISA™(语言指令集架构)的支持,可无缝从**终端设备扩展到本地环境**,让企业能够**为 40 亿到 7000 亿参数的模型合理配置规模,而无需过度预置。**
其结果是一类新型 AI 基础设施:**数据主权、可预测成本以及确定性性能**——解锁企业应用中的智能体 AI 工作流,无需承担按词元付费的云端推理隐性成本。
“***推理已成为主导性的 AI 工作负载,基础设施需要反映这一现实。******超大规模 GPU 集群支撑超大语言模型的时代已经结束。HyperThought 将 AI 从仅限超大规模云服务商的复杂性,转变为每个企业都能使用的单卡简洁方案。***”
—— William Wei,Skymizer 首席营销官
“***专用解码硬件配合智能软件栈,编排每一次推理工作负载——这才是大规模分离预填充/解码的正确方式。***”
—— Luba Tang,Skymizer 首席技术官
随着 AI 模型从**数十亿扩展到数万亿参数**,HTX301 标志着超越了蛮力 GPU 扩展的关键一步——为企业提供了一条**更简单、更高效、更易于部署的 AI 路径。**
#### 继续阅读
skymizer logo
## 总部
台湾台北市内湖区瑞光路408号12楼之2(11492)
## 新竹办公室
台湾新竹市光复路二段101号创新育成中心R819室
© 2026 • Skymizer Taiwan Inc.
页面加载链接 (https://skymizer.ai/skymizer-announces-htx301-reinventing-on-prem-ai-inference/#)
相似文章
一家小型公司抢了AMD的风头,凭借采用老旧DDR4和28nm芯片的PCIe AI加速器,以仅240W功耗在本地运行700B参数大模型,向Nvidia发起挑战
台湾初创公司Skymizer发布了HTX301,这是一款PCIe AI加速器,采用较老的28nm芯片和DDR内存,仅需240W功耗即可在本地运行700B参数的大语言模型,对Nvidia和AMD的高功耗GPU解决方案构成挑战。
我实测了 CMP170HX
对英伟达 CMP170HX 矿卡改作 64GB 显存 AI 推理加速器的实测基准测试,表明它们能以可用速度运行大型本地 LLM(如 DeepSeek V4-Flash 和 gpt-oss-120B),但存在 Ampere 级吞吐量和 PCIe Gen2 x4 连接方面的注意事项。
@HotAisle: 太棒了。我想知道他们用的是谁的 MI300x... ;-)
Kog 宣布在标准数据中心 GPU 上实现每请求每秒 3000+ 输出令牌的实时大语言模型推理,将此前仅限于定制芯片的高速推理引入生产硬件。
@SKhynix:认识一下CMM-Ax,这是@SKhynix与Marvell Technology共同开发的基于ASIC的CXL-PNM解决方案。旨在克服内存瓶…
SK海力士推出CMM-Ax,这是与Marvell Technology共同开发的基于ASIC的CXL-PNM解决方案,旨在克服长上下文LLM推理中的内存瓶颈,吞吐量比仅使用GPU的系统最高提升5.5倍。
英特尔新月岛PCB泄露,展示巨大Xe3P GPU、16针接口、160GB LPDDR5X,英特尔规避HBM短缺
泄露的PCB图片显示了英特尔即将推出的Crescent Island AI加速器,配备大型Xe3P GPU和160 GB LPDDR5X内存,旨在作为AI推理中基于HBM的解决方案的经济高效替代方案。