webgpu

标签

Cards List
#webgpu

@PierceZhang34: 10秒训练一个小模型! LLM 训练神器:http://llm.istanbul 初体验 最近发现了一个超级有趣的开源风格工具网站 —— http://llm.istanbul,它号称 WebGPU LLM Workbench,意思是完全…

X AI KOLs Timeline · 2026-06-12 缓存

介绍了一个名为 llm.istanbul 的 WebGPU LLM 工作台,可在浏览器中训练小模型、训练分词器并生成文本。无需服务器,完全本地运行。

0 人收藏 0 人点赞
#webgpu

ggml-webgpu: 提升k-quants的预填充速度并重构Q4/Q5/Q8及k-quants的矩阵乘法 by yomaytk · Pull Request #24225 · ggml-org/llama.cpp

Reddit r/LocalLLaMA · 2026-06-09 缓存

提升了k-quants的预填充速度,并重构了llama.cpp WebGPU后端中Q4/Q5/Q8及k-quants的矩阵乘法。

0 人收藏 0 人点赞
#webgpu

@hank_aibtc: WTF?图像生成彻底变天了! PrismML 刚刚放出 Bonsai Image 4B —1-bit 二值和三值量化扩散模型! - 模型才 ~3GB(1-bit 版甚至压到 0.93GB), 而同参数的 FLUX.2 Klein 4B 要…

X AI KOLs Timeline · 2026-05-29 缓存

PrismML 发布了 Bonsai Image 4B,一种 1-bit 二值和三值量化扩散模型,大小仅为 3GB(1-bit 版 0.93GB),相比同参数 FLUX.2 Klein 4B 的 16GB 压缩了 8 倍以上,并支持完全本地化浏览器运行。

0 人收藏 0 人点赞
#webgpu

@nicodotdev:关于 Transformers.js 你一直想了解的一切,都在一个视频中。我深入探讨了 AI 模型如何从…运行

X AI KOLs Following · 2026-05-27 缓存

一个深入探讨的视频,解释如何使用 Transformers.js 从 JavaScript 运行 AI 模型,涵盖张量、ONNX、量化、WebGPU/WASM 等。

0 人收藏 0 人点赞
#webgpu

@hank_aibtc: 卧槽 OpenAI 终于干了件人事!!! 2026 年第一个开源模型来了——Privacy Filter, Apache 2.0 直接放出! 1.5B 参数的 PII(个人信息) 检测神器, 专门把文本里的姓名、地址、电话、邮箱、身份证这…

X AI KOLs Timeline · 2026-05-27 缓存

OpenAI 开源了 Privacy Filter 模型(1.5B 参数,Apache 2.0),用于在浏览器本地通过 WebGPU 检测个人信息,无需上传数据,保护隐私。

0 人收藏 0 人点赞
#webgpu

PrismML 刚刚发布了二值和三值的 Bonsai Image 4B:一种 1比特/三值文本到图像扩散变换器,甚至可以在浏览器中通过 WebGPU 100% 本地运行。

Reddit r/LocalLLaMA · 2026-05-26

PrismML 发布了 Bonsai Image 4B 模型的二值和三值量化版本,使得文本到图像生成可以仅用 3GB 大小通过 WebGPU 在浏览器中本地运行,采用 Apache-2.0 许可证。

0 人收藏 0 人点赞
#webgpu

@ggerganov:突出展示 llama.cpp/ggml 中的新 WebGPU 后端 为在 llama.cpp 中实现完整 WebGPU 支持的工作始于…

X AI KOLs Following · 2026-05-22 缓存

本文重点介绍了 llama.cpp/ggml 中的全新 WebGPU 后端,它能够在浏览器中实现 GPU 加速的本地 AI 模型推理,由 Reese Levine 及其在 USCS 的团队在过去一年半中开发完成。

0 人收藏 0 人点赞
#webgpu

@ekzhang1: 致敬karpathy加入Anthropic:制作了一个浏览器内(WebGPU)版本的著名char-rnn 'Unreasonable effectiveness of RNNs'演示,在莎士比亚数据集上训练

X AI KOLs Following · 2026-05-20 缓存

创建了一个在浏览器中运行的WebGPU版本的经典char-rnn演示,在莎士比亚数据集上训练,以向加入Anthropic的Karpathy致敬。

0 人收藏 0 人点赞
#webgpu

@ngxson: Qwen3.6-27B 在 WebGPU 上 100% 运行。速度不是最快,但仍然不错

X AI KOLs Following · 2026-05-17 缓存

一位开发者演示在浏览器中完全通过 WebGPU 运行 Qwen3.6-27B AI 模型,尽管速度并非最优。

0 人收藏 0 人点赞
#webgpu

使用 Transformers.js 在 WebGPU 上完全离线运行 Gemma 4,并通过 WebSerial 控制 Reachy Mini

Reddit r/LocalLLaMA · 2026-05-11

演示了如何使用 WebGPU 和 Transformers.js 在浏览器中离线运行 Gemma 4,并通过 WebSerial 控制 Reachy Mini 机器人。

0 人收藏 0 人点赞
#webgpu

@xenovacom:Opus 4.7 刚写了一个定制 WebGPU 内核,用融合 LinearAttention 算子把 Qwen3.5 推理速度提升最高 13 倍!智能内核…

X AI KOLs Following · 2026-04-23 缓存

Opus 4.7 自动生成定制 WebGPU 内核,通过融合 LinearAttention 将 Qwen3.5 推理加速最高 13 倍,现已随 Transformers.js v4.2.0 发布。

0 人收藏 0 人点赞
#webgpu

pascalorg/editor

GitHub Trending (daily) · 2026-05-19 缓存

一个使用 React Three Fiber 和 WebGPU 构建的3D建筑编辑器,采用 Turborepo 单体仓库结构,包含 core、viewer 和 editor 包,分别用于模式定义、3D渲染和交互工具。

0 人收藏 0 人点赞
#webgpu

ArthurBrussee/brush

GitHub Trending (daily) · 2026-05-13 缓存

Brush 是一个开源的 3D 重建引擎,采用高斯泼溅(Gaussian Splatting)技术,使用 Rust 构建,并兼容 WebGPU,支持在桌面、移动端和浏览器上进行跨平台实时渲染。

0 人收藏 0 人点赞
#webgpu

Augani/openreel-video

GitHub Trending (daily) · 2026-05-08 缓存

OpenReel Video 是一个基于浏览器的开源专业视频编辑器,使用 React、TypeScript、WebCodecs 和 WebGPU 构建,完全在客户端运行,无需上传或安装。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈