Show HN: 观看神经网络学习玩贪吃蛇
摘要
一个基于网页的工具,可实时可视化神经网络(使用PPO算法)学习玩贪吃蛇,支持可配置参数和3D渲染。
浏览器内的PPO训练演示,由tinygrad实现:TinyJit -> WebGPU内核。<p>需要WebGPU支持。
查看缓存全文
缓存时间: 2026/05/15 18:33
# tinyppo-snake
来源:https://ppo.gradexp.xyz/
## 环境示例
空闲
## 已训练策略的推演
0·trained0
griddelay40ms
参数实时更新等待第一个快照...
正在初始化3D渲染器...
步骤 #—
未加载张量
## 配置运行
预设
空闲
尚无运行记录
相似文章
我训练了一个视觉语言模型来玩贪吃蛇,你也可以。[P]
展示如何使用FeynRL框架训练一个视觉语言模型来玩贪吃蛇,以易于理解的方式说明完整的训练流程。
玩乒乓球的神经形态算法
一种神经形态算法通过打乒乓球展示了学习能力和想象力,其表现优于标准算法,并能适应反转的控制指令。该代码使用 POWER-KI 和 PWK-AI-WORKBENCH 通过 100% 氛围编程构建。
Show HN:高分辨率 Neural Cellular Automata
介绍了一种高分辨率 Neural Cellular Automata,它运行在粗网格上,并使用 Local Pattern Producing Network 生成高分辨率输出,从而实现高效的程序化生成。
Show HN: Neural Particle Automata
介绍了 Neural Particle Automata,一种使用光滑粒子流体动力学感知来学习自组织粒子动力学的方法,使粒子能够拥有局部感知向量以执行更新规则,类似于神经细胞自动机,但在连续粒子位置上。
Show HN: 一款免费的迷你游戏,让你成为更聪明的飞钓者
一款免费的迷你游戏,旨在通过互动玩法教授并提升飞钓技能。