gpu-computing

标签

Cards List
#gpu-computing

PowerZooJax:一个基于 JAX 的电力系统强化学习基准平台

arXiv cs.AI ↗ · 2天前 缓存

来自南洋理工大学、康奈尔大学和布里斯托大学的研究者提出了 PowerZooJax,这是一个面向电力系统运行强化学习的开源 JAX 基准套件,提供了五个带约束的 MDP 任务(发电、输电、配电、分布式能源资源、数据中心微电网),可完全在 GPU 上运行,相比基于 CPU 的仿真器实现了大幅加速。

0 人收藏 0 人点赞
#gpu-computing

使用Facet测试WebGPU数据布局

Hacker News Top ↗ · 3天前 缓存

本文解释了Rust和WebGPU之间结构布局的细微差异,并介绍了使用naga进行单元测试的方法,以验证内存偏移,从而实现更安全的GPU计算着色器配置。

0 人收藏 0 人点赞
#gpu-computing

关于动态图形的Opus 5.5帖子很酷,但Qwen 27B在4090上做了这个

Reddit r/LocalLLaMA ↗ · 4天前

本文讨论了使用Qwen 27B模型在4090 GPU上创建动态图形,突出了受Opus 5.5启发的本地AI能力。

0 人收藏 0 人点赞
#gpu-computing

Show HN: 智能代理CUDA内核优化器

Hacker News Top ↗ · 6天前 缓存

一个智能代理CUDA内核优化器,通过迭代代码生成、正确性检查、基准测试和优化,自动化GPU实现生成,由LangGraph和OpenAI模型驱动。

0 人收藏 0 人点赞
#gpu-computing

vgpu

Product Hunt ↗ · 2026-09-22 缓存

vgpu 是一个针对 WebGPU 的 TypeScript 库,具有类型化着色器导入、一个轻量级的 GPU 优先 API,并兼容浏览器、无头 Node 和测试环境。

0 人收藏 0 人点赞
#gpu-computing

@TensorTonic: 在机器学习中,RBF核函数用于衡量点之间的相似性。增加gamma值会使相似性随距离下降更快…

X AI KOLs Timeline ↗ · 2026-09-21 缓存

TensorTonic是一个通过编码实践学习机器学习的在线平台,该帖子以解释RBF核函数开头。

0 人收藏 0 人点赞
#gpu-computing

在 RTX 3060 + 5060 Ti 上成功运行 Qwen 3.8 27B EXL3

Reddit r/LocalLLaMA ↗ · 2026-09-20

一名用户成功运行了 Qwen 3.8 27B AI 模型在 RTX 3060 和 5060 Ti GPU 的混合设置上,使用 exllamav3 的张量并行技术,在启用 MTP 的情况下达到约每秒 50 个令牌的速度。

0 人收藏 0 人点赞
#gpu-computing

@yibie: https://x.com/yibie/status/2101491585741394047

X AI KOLs Timeline ↗ · 2026-09-20 缓存

本文详细解释了MoE(混合专家)推理工程,纠正了关于激活参数与部署成本的误解,并深入探讨了路由器选择、运行时分组、GPU执行、内存管理和专家并行等技术细节。

0 人收藏 0 人点赞
#gpu-computing

在AMD MI50上使用Vulkan训练神经网络:概念验证——或:我为何不再听从,直接行动

Reddit r/LocalLLaMA ↗ · 2026-09-19

作者展示了如何强制AMD MI50 GPU与ROCm 6.4.3配合工作,并构建了一个基于Vulkan的神经网络训练栈,挑战了关于旧硬件支持的共识。

0 人收藏 0 人点赞
#gpu-computing

@MTSlive: 检测到情况:Periodic Labs使用了1,300个H200,加上数月自己的实验数据,来训练和强化学习一个开放权重模型…

X AI KOLs Timeline ↗ · 2026-09-15

Periodic Labs训练了一个开放权重AI模型,使用1,300个NVIDIA H200 GPU和内部实验室数据,在其内部基准测试中超越了GPT-6 Astra。

0 人收藏 0 人点赞
#gpu-computing

双 AMD Radeon AI Pro R9700 或双 NVIDIA RTX 3090。

Reddit r/LocalLLaMA ↗ · 2026-09-15

作者正在构建一个双 GPU 系统,用于运行大型语言模型,评估 AMD Radeon AI Pro R9700 与 NVIDIA RTX 3090 选项,同时旨在降低 AI 订阅成本。

0 人收藏 0 人点赞
#gpu-computing

Kanverse GPU Borrow

Product Hunt ↗ · 2026-09-13 缓存

Kanverse GPU Borrow 是一款产品,允许设备在用户明确授权下,通过 Blink Bridge 临时借用其他机器的GPU计算资源,并由 GPT-6 Astra 编排。

0 人收藏 0 人点赞
#gpu-computing

RSA 260 的因子分解

Hacker News Top ↗ · 2026-09-09 缓存

Cognition 的研究人员利用 AI 代理 Devin 成功分解了 RSA-260,在 RSA 因子分解挑战中创下新纪录,并展示了自主软件工程在密码学研究中的潜力。

0 人收藏 0 人点赞
#gpu-computing

@charles_irl: Modal 位于 GPU 层之上

X AI KOLs Timeline ↗ · 2026-09-09 缓存

Modal 是一个运行在 GPU 层之上的无服务器平台,简化了开发者对 GPU 的访问。

0 人收藏 0 人点赞
#gpu-computing

@charles_irl:为打造构建构建 bufo 的机器的机器而自豪(https://modal.com)

X AI KOLs Timeline ↗ · 2026-09-07 缓存

这是关于 Modal 的推广帖子,Modal 是一个 AI 基础设施平台,提供 SDK、自动扩展和生产就绪工具,同时宣布了面向 AI 工程师的 Runtime 大会。

0 人收藏 0 人点赞
#gpu-computing

@pavelsimo: 我已经解决了LeetGPU上所有的注意力问题。将它们全部放在一处,以便轻松找到:1/13

X AI KOLs Timeline ↗ · 2026-09-07 缓存

一位用户宣布他们已经解决了LeetGPU上所有与注意力相关的问题,并将它们编译成一个易于访问的资源。

0 人收藏 0 人点赞
#gpu-computing

@jessiedong_: split-K 矩阵乘法即使在代码和输入相同的情况下也以给出不同的答案而闻名。但 h…

X AI KOLs Timeline ↗ · 2026-09-02 缓存

本文描述了关于 split-K 矩阵乘法的实验,揭示了答案的变异性取决于块布局和分割计数,在 B200 GPU 上的测试显示了不同条件下的输出变化。

0 人收藏 0 人点赞
#gpu-computing

GPU 世界

Hacker News Top ↗ · 2026-09-01 缓存

这篇文章描述了一个故事竞赛,邀请人们想象一个GPU丰富的未来,使得AI在2040年前触手可及,并探讨了潜在的社会影响。

0 人收藏 0 人点赞
#gpu-computing

运行8x RTX PRO 6000的实用指南

Hacker News Top ↗ · 2026-08-31 缓存

本文提供了运行8x NVIDIA RTX PRO 6000 Blackwell GPU处理AI工作负载的实用指南,重点介绍高并发推理、模型集群和70B微调,同时与更昂贵的数据中心解决方案进行性能比较。

0 人收藏 0 人点赞
#gpu-computing

SlopTV:基于YouTube聊天评论的无限AI垃圾内容直播,使用Minimax H3与2x5090

Reddit r/LocalLLaMA ↗ · 2026-08-31 缓存

SlopTV是一个AI直播,利用Minimax H3在双5090 GPU上根据YouTube聊天评论生成无限内容。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈