power-efficiency

标签

Cards List
#power-efficiency

@FutureJurvetson: 这太疯狂了。Unconventional AI 的首个模拟 AI 芯片(使用耦合谐振器阵列)生成图像……

X AI KOLs Timeline ↗ · 2026-09-17 缓存

Unconventional AI 的首个模拟 AI 芯片,使用耦合谐振器,生成图像仅需不到 900 纳焦,号称在 AI 硬件能效上提升了 1000 倍。

0 人收藏 0 人点赞
#power-efficiency

NVIDIA报告称,Vera Rubin的智能体吞吐量每兆瓦最高提升30倍——但每兆瓦的令牌数仍不等同于每兆瓦的完成工作量

Reddit r/ArtificialInteligence ↗ · 2026-08-26

NVIDIA报告称,与GB300相比,Vera Rubin的每兆瓦智能体吞吐量最高提升30倍,但强调生产基准测试应包含超越每瓦令牌数的额外指标。

0 人收藏 0 人点赞
#power-efficiency

@tbpn: Parasma 创始人兼CEO @vytalow,此前因训练人类脑细胞玩 Doom 而走红,他表示使用……

X AI KOLs Timeline ↗ · 2026-08-13 缓存

Parasma 创始人兼CEO @vytalow 认为,使用人类脑细胞进行计算可能比硅芯片节能得多,并指出了功耗效率、样本效率和持续学习方面的优势。

0 人收藏 0 人点赞
#power-efficiency

我的 Strix Halo 每天最多花费 0.48 美元

Reddit r/LocalLLaMA ↗ · 2026-07-10

本文比较了在 Strix Halo(每天最多 0.48 美元)与 Nvidia A6000 上运行 AI 模型的能源成本,强调了能效和多功能性。

0 人收藏 0 人点赞
#power-efficiency

@gabriel1:推理将成为全球最大的市场,智能的需求无限,Etched 正在带来 AI 夏天

X AI KOLs Timeline ↗ · 2026-06-30 缓存

AI 推理硬件初创公司 Etched 在获得 8 亿美元融资并签署超过 10 亿美元客户合同后结束隐身模式。首批机架将于今年夏季发货,声称在吞吐量、延迟和能效方面达到业界领先水平。

0 人收藏 0 人点赞
#power-efficiency

Databricks前AI负责人认为可将AI能耗降低1000倍

TechCrunch AI ↗ · 2026-06-25 缓存

由Databricks前AI负责人Naveen Rao领导的Unconventional AI公司声称,其基于振荡器的计算机架构可将AI推理能耗降低多达1000倍,并已通过其首个图像生成模型Un0进行了验证。

0 人收藏 0 人点赞
#power-efficiency

Gemma 12b 低于10瓦 6.5pp 1.3tg

Reddit r/LocalLLaMA ↗ · 2026-06-14

在Google Pixel 10 Pro上使用llama.cpp运行Gemma 12B模型,实现了每秒6.5个token的提示处理和每秒1.3个token的生成,功耗低于10瓦,展示了高效的设备端AI推理。

0 人收藏 0 人点赞
#power-efficiency

@rohanpaul_ai: Nvidia发布了其与Lambda合作的光子共封装光学(CPO)交换机的视频。AI竞赛不仅仅是关于……

X AI KOLs Following ↗ · 2026-06-10 缓存

Nvidia推出了与Lambda合作的光子共封装光学交换机,旨在减少大型GPU集群在AI工作负载中的功耗和故障点。

0 人收藏 0 人点赞
#power-efficiency

小型LLM基准测试:Jetson Orin Nano Super 8GB - 四种功率模式 × 八种模型

Reddit r/LocalLLaMA ↗ · 2026-06-02

一项对8个小型LLM(参数规模从1.35亿到约10亿)在售价250美元的Jetson Orin Nano Super上进行的深入基准测试,涵盖四种功率模式,发现25W是帕累托最优模式,其中SmolLM2-135M达到165.1 tok/s,效率最高。

0 人收藏 0 人点赞
#power-efficiency

RTX 5090(600/475/400W)与 RTX 6000 PRO MaxQ(325W)以及 RTX 6000 PRO WS/SE(600W)完整算力(Anima)小对比

Reddit r/LocalLLaMA ↗ · 2026-05-26

一位用户对 RTX 5090 和 RTX 6000 PRO 系列 GPU 进行 AI 扩散任务基准测试,比较不同功耗限制下的性能,展示了速度与功耗之间的权衡。

0 人收藏 0 人点赞
#power-efficiency

探寻4x 3090的甜点

Reddit r/LocalLLaMA ↗ · 2026-05-15

一位用户分享了在运行Qwen3.6-27B与vLLM的4x RTX 3090平台上进行的功耗限制测试,发现220W是在最小化吞吐量损失下实现峰值效率的甜点。

0 人收藏 0 人点赞
#power-efficiency

[基准测试] 5090RTX:提示解析、Token 生成与功耗等级

Reddit r/LocalLLaMA ↗ · 2026-05-14

一位用户使用 llama.cpp 对 Nvidia 5090 RTX GPU 进行 LLM 推理基准测试,测量了不同功耗水平下的提示处理和 token 生成情况,发现提示处理对功耗限制更为敏感,而 token 生成相对不敏感,并指出了与 4090 RTX 的差异。

0 人收藏 0 人点赞
#power-efficiency

双 DGX Spark(华硕 GX10)MiniMax M2.7 实测

Reddit r/LocalLLaMA ↗ · 2026-04-21

用户实测两台华硕 GX10(DGX Spark)运行 MiniMax-M2.7-AWQ-4bit,每块仅约 100 W,生成速度 30–40 tokens/s,彻底替代嘈杂的多 GPU 机架。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈