ai-accelerators

标签

Cards List
#ai-accelerators

内存现占AI加速器制造成本的63%,较2024年初的52%有所上升

Reddit r/ArtificialInteligence ↗ · 2026-09-13

内存现占AI加速器成本的63%,较2024年初的52%上升,这使得行业优先事项从工艺缩小转向数据移动优化。

0 人收藏 0 人点赞
#ai-accelerators

三星发布zHBM原型,直接在AI加速器上堆叠内存

Hacker News Top ↗ · 2026-09-07 缓存

三星在FMS 2026会议上发布了zHBM和zNAND-O内存技术,旨在将内存直接堆叠在AI加速器上,为AI系统提供高达8倍的更高性能和改进的能效。

0 人收藏 0 人点赞
#ai-accelerators

@Modular: 可移植性横跨CPU、GPU和加速器,看似简单,实则不然。在#ModCon2026上,@clattner…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

Modular首席执行官Chris Lattner与高通首席执行官Cristiano Amon在ModCon2026大会上探讨了CPU、GPU及加速器间的可移植性问题,重点强调了高通收购Modular后双方在异构计算软件改进上的合作。

0 人收藏 0 人点赞
#ai-accelerators

Mojo 现已开源

Lobsters Hottest ↗ · 2026-08-18 缓存

Mojo 是一种专为AI加速器和GPU设计的编程语言,现已在Apache 2.0许可下完全开源,其编译器和工具链已在GitHub上提供,用于开发和贡献。

0 人收藏 0 人点赞
#ai-accelerators

展示HN: 通过GPU寄存器中的流体动力学修复光学计算抖动

Hacker News Top ↗ · 2026-08-09 缓存

该仓库展示了一个概念验证,用于一个硬件原生的光学时序冻结控制平面引擎,该引擎利用GPU寄存器中的流体动力学建模来减少分布式AI架构中光学数据中心的抖动。

0 人收藏 0 人点赞
#ai-accelerators

中国企业正在放弃英伟达的高端加速器,转向国内AI供应商

Reddit r/ArtificialInteligence ↗ · 2026-07-08 缓存

中国企业越来越多地将AI加速器预算分配给华为和Hygon等国内供应商,在中美紧张局势下减少对英伟达的依赖。彭博社一项调查显示,未来一年内46%的支出将用于国内产品,高于之前的30%。

0 人收藏 0 人点赞
#ai-accelerators

@yishan: Meta 真的搞砸了这个人。

X AI KOLs Timeline ↗ · 2026-07-07 缓存

John Carmack 评论了关于AI加速器的内存成本和容量问题,指出模型推理可以有确定性的内存访问模式,这与游戏渲染形成对比。

0 人收藏 0 人点赞
#ai-accelerators

@QuixiAI: https://x.com/QuixiAI/status/2073936537213915611

X AI KOLs Following ↗ · 2026-07-06 缓存

QuixiAI 发布了 QuixiCore,这是一系列面向现代加速器的原生高性能 AI 内核库,为 CUDA、Metal、ROCm、XPU 和 Gaudi 后端提供了独立的实现,所有实现共享一个通用契约但没有共享代码。

0 人收藏 0 人点赞
#ai-accelerators

7家中国公司已开始出货H100/H200级别的AI芯片,其中多数在过去6个月内上市。我梳理了所有这些公司的格局。

Reddit r/LocalLLaMA ↗ · 2026-06-23

至少有七家中国公司正在出货H100/H200级别的AI加速器,多数近期上市,部分由前NVIDIA/AMD架构师创立。华为昇腾950瞄准H200级别性能,中国本土市场份额随着NVIDIA份额下降而上升。

0 人收藏 0 人点赞
#ai-accelerators

在中国购买AI加速器/GPU……

Reddit r/LocalLLaMA ↗ · 2026-06-15

用户询问在中国购买用于推理的国产AI加速器/GPU,特别是寻找华为替代英伟达的产品,并希望支持vLLM或Llama.cpp。

0 人收藏 0 人点赞
#ai-accelerators

KForge:面向AI加速器的LLM驱动跨平台内核生成

arXiv cs.LG ↗ · 2026-06-03 缓存

KForge是一个跨平台框架,利用两个协作的基于LLM的智能体,自动生成和优化适用于多种AI加速器的高性能计算内核,在NVIDIA B200和Intel Arc B580硬件上实现了显著的加速效果。

0 人收藏 0 人点赞
#ai-accelerators

TRAM:为低功耗 AI 加速器训练近似乘法器结构

arXiv cs.LG ↗ · 2026-05-12 缓存

本文介绍了 TRAM,一种联合优化近似乘法器结构和 AI 模型参数的方法,旨在降低 AI 加速器的功耗,同时保持模型精度。

0 人收藏 0 人点赞
#ai-accelerators

AccelOpt:一种用于AI加速器内核优化的自我改进LLM智能体系统

Hugging Face Daily Papers ↗ · 2026-04-15 缓存

AccelOpt是一种自我改进的LLM智能体系统,通过迭代生成和优化记忆自主优化AI加速器内核,在AWS Trainium上实现了49%至61%的峰值吞吐量提升,同时比Claude Sonnet 4便宜26倍。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈