hardware-acceleration

标签

Cards List
#hardware-acceleration

@charliermarsh:原来我忘了为 ARM 启用硬件加速的 SHA-256。所以 uv 在下一个版本中会快很多……

X AI KOLs Following · 昨天 缓存

在启用 ARM 的硬件加速 SHA-256 后,uv 将在下一个版本中提速,将 Trio 安装的墙上时间提升高达 10%。

0 人收藏 0 人点赞
#hardware-acceleration

@googlegemma: Gemma 4 现在可以使用 React Native 在设备端运行!你现在可以在跨平台应用中完全离线运行 Gemma 4,并支持……

X AI KOLs Timeline · 2026-07-08 缓存

Gemma 4 现在可以使用 React Native 在设备端完全离线运行,通过 Android 上的 Vulkan 和 Apple Silicon 上的 MLX 实现本地硬件加速,支持视觉和工具使用能力,例如阅读传单和安排日程,完全在设备端完成。

0 人收藏 0 人点赞
#hardware-acceleration

注意:系统托盘中的几个聊天应用为自己预留了1GB显存。

Reddit r/LocalLLaMA · 2026-07-03

Discord、Steam和Telegram等应用即使在最小化时也会预留显存,总共消耗1GB以上;使用大语言模型(LLM)的用户应关闭这些应用或禁用硬件加速以释放显存。

0 人收藏 0 人点赞
#hardware-acceleration

@Underfox3: 本文基于对 Apple 硅芯片的直接测量,呈现了 Apple Neural Engine 的全面指南,…

X AI KOLs Timeline · 2026-06-28 缓存

一份全面的 Apple Neural Engine 逆向工程指南,详细介绍了其在 A11 至 A18 和 M1 至 M5 芯片上的架构、编程接口和性能,基于对私有运行时、编译器和固件的直接测量和静态分析。

0 人收藏 0 人点赞
#hardware-acceleration

@manateelazycat: 这个万能下载器太牛逼了 你只需在微信里把视频链接发给机器人,系统会自动识别平台、解析下载、转码整理,并把视频回传到微信——全程无需打开电脑、无需复制粘贴到第三方网站 支持抖音、快手、微博、小红书、B站、微信视频号、YouTube、Inst…

X AI KOLs Timeline · 2026-06-26 缓存

介绍一个万能下载器,用户只需在微信中将视频链接发送给机器人,系统会自动识别平台、解析下载、转码并回传视频,支持抖音、YouTube等14+平台,内置ffmpeg和GPU硬件加速。

0 人收藏 0 人点赞
#hardware-acceleration

[x86] AI计算扩展(ACE)规范

Hacker News Top · 2026-06-18 缓存

x86生态系统咨询小组发布了AI计算扩展(ACE)规范,该规范定义了新的x86指令和寄存器状态,用于加速机器学习工作负载中的矩阵乘法和低精度数据格式。

0 人收藏 0 人点赞
#hardware-acceleration

GateGPT: 在80 MHz的FPGA上实现每秒56k tokens的Transformer(KV缓存)

Hacker News Top · 2026-06-16 缓存

一个自定义的FPGA实现,在80 MHz下运行带KV缓存的Transformer,实现每秒56,000 tokens,在微型LCD上运行microGPT。

0 人收藏 0 人点赞
#hardware-acceleration

@MSFTResearch: 30倍加速分析,从SQL自动生成GPU内核,AI匹配实验室培养的肿瘤模型用于癌症治…

X AI KOLs Following · 2026-06-15 缓存

微软研究院在最新的Research Focus通讯中重点介绍了多项进展,包括使用CoddSpeed实现30倍加速分析、AI野生动物重新识别,以及无需重新训练即可跨任务学习的LLM。

0 人收藏 0 人点赞
#hardware-acceleration

@FGuzmanAI: 仅80 MHz下每秒56,000+ tokens。我将完整Transformer(含KV缓存)烧录到定制芯片中。逐门设计……

X AI KOLs Timeline · 2026-06-13 缓存

一款逐门定制的数字芯片,在仅80 MHz频率下运行含KV缓存的Transformer,实现每秒超过56,000 tokens,并在FPGA上完成原型验证。

0 人收藏 0 人点赞
#hardware-acceleration

通过Kolmogorov-Arnold网络在FPGA上实现超快机器学习

Hacker News Top · 2026-06-09 缓存

本文介绍了作者的硕士论文,该论文利用Kolmogorov-Arnold网络(KAN)在FPGA上实现超快机器学习,通过自定义硬件架构实现亚微秒级推理和在线学习。文章引用了两篇已接收的论文:基于LUT评估的KANELÉ(FPGA 2026最佳论文奖)以及一种在FPGA上进行在线学习的方法(ICML 2026)。

0 人收藏 0 人点赞
#hardware-acceleration

OpenCV 5 正式发布:计算机视觉多年来的最大飞跃

Hacker News Top · 2026-06-06 缓存

OpenCV 5 是计算机视觉库的重大版本更新,包含全新的 DNN 引擎、改进的 ONNX 支持、硬件加速以及更简洁的架构。对于从事经典视觉、深度学习及边缘部署的开发者而言,这标志着一次重要的现代化升级。

0 人收藏 0 人点赞
#hardware-acceleration

构建了一个AI加速器并将其开源。[P]

Reddit r/MachineLearning · 2026-05-31

作者开源了一个在FPGA上实现的自定义AI加速器(atik),原生支持BF16和注意力机制,展示了在各种模型上相比PyTorch的显著加速效果。

0 人收藏 0 人点赞
#hardware-acceleration

学习跳跃块:自我发现的超度量路由用于硬件加速稀疏注意力

Reddit r/artificial · 2026-05-30

本文介绍了动态超度量注意力(Dynamic Ultrametric Attention),这是一个框架,其中Transformer在训练期间学习每头块稀疏路由拓扑,然后在推理时将这些拓扑卸载到自定义的Triton块稀疏内核上,与密集注意力相比,实现了高达28倍的加速和98.4%的内存减少。

0 人收藏 0 人点赞
#hardware-acceleration

Stratum:采用3D堆叠DRAM的系统硬件协同设计以实现高效MoE

Hacker News Top · 2026-05-15

介绍了Stratum,一种采用3D堆叠DRAM的系统硬件协同设计方法,以高效加速混合专家(MoE)模型。

0 人收藏 0 人点赞
#hardware-acceleration

@mitsuhiko: 而且 ds4 SSD 缓存表现非常出色。这是在服务器关机后继续一个已经处理了 63k 令牌的会话……

X AI KOLs Timeline · 2026-05-11 缓存

一名用户反馈,在恢复包含 63k 令牌的长周期 LLM 推理会话时,ds4 SSD 缓存的性能表现良好,并指出启动时间尚可接受。

0 人收藏 0 人点赞
#hardware-acceleration

在Ryzen AI 7 350 NPU上达到峰值TOPS性能

Lobsters Hottest · 2026-05-08 缓存

关于在AMD Ryzen AI 7 350 NPU上实现峰值TOPS性能的技术深度剖析,与Xilinx AIE-ML v2 AI引擎进行比较,并解释用于矩阵乘法工作负载的硬件架构。

0 人收藏 0 人点赞
#hardware-acceleration

打造一台1997年玩《雷神之锤》的PC:VQuake性能基准测试

Fabien Sanglard · 2026-01-13 缓存

一篇详细的回顾文章,讲述如何组装一台1997年时代的《雷神之锤》PC,并对硬件加速版VQuake进行基准测试,重点介绍Rendition Verite 1000显卡及其独特功能,包括双线性过滤和全亮度支持。

0 人收藏 0 人点赞
#hardware-acceleration

AIEraDev/Clypra

GitHub Trending (daily) · 2026-07-14 缓存

Clypra 是一款免费开源的专业视频编辑器,基于 Tauri v2、React 19 和 Rust 构建,支持硬件加速处理及可选的 AI 驱动功能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈