@yoheinakajima: 这东西太酷了
摘要
Marc在VisionCamera中演示了利用DINOv2和Apple Vision框架的深度感知光注入,并通过react-native-webgpu实现了实时渲染。
查看缓存全文
缓存时间: 2026/08/21 13:16
这玩意儿太酷了
Marc (@mrousavy): VisionCamera 中的深度感知光注入技术
该技术能在 448x336 帧尺寸下,通过 DINOv2 深度检测和 Apple VN 手部检测实现低于 25 毫秒的处理速度,随后借助 react-native-webgpu 进行零拷贝的光照与阴影渲染——当我移动那束隐形光线时,感觉自己就像钢铁侠一样 🦸🏻♂️
相似文章
@yoheinakajima: 全新的 http://di.gg 看起来很棒!
这是来自 Digg 的热门 AI 新闻汇总,涵盖了 Neuralink 脑机接口植入物、NVIDIA 针对 Claude Code 的性能修复、Anthropic 的政策立场以及 Flowception 视频建模代码的发布等话题。
@reczko_konrad: TypeGPU中的深度感知光注入 我将一个448x448的单目深度模型在M4 Pro上优化到约8毫秒,跨约250次调度…
一位开发者通过使用TypeGPU优化448x448模型在M4 Pro上以约8毫秒的速度运行,实现了实时单目深度估计,从而允许深度感知照明无缝集成到GPU中。
@yoheinakajima:一个人的模糊是另一个人的运动数据,用以解码
介绍了Blur2Vid,一种从运动模糊图像生成视频的方法,发表于SIGGRAPH Asia 2025。
Show HN: 通过 WebGPU 在浏览器中运行 Manim(3Blue1Brown 的动画引擎)
Academa Studio 使用 WebGPU 将 3Blue1Brown 的 Manim 动画引擎带到浏览器,实现原生 AI 的 Manim 编辑,无需本地环境配置。
@HowToPrompt__: 3D艺术家应该停止讨厌AI.. 这个适用于Blender、Unity和UE5的插件可将任何网络摄像头视频转换为完整的3D动作数…
一个免费的适用于Blender、Unity和UE5的插件,可将任何网络摄像头视频实时转换为3D动作数据,具有208个骨骼点和0.1秒延迟,可在8GB显存的本地运行。