@vicky_grok: 这太疯狂了!NVIDIA 的文本转动作模型现在无需 NVIDIA 的技术栈就能运行。输入一句话。获得人类动作。在……

X AI KOLs Timeline 新闻

摘要

NVIDIA 的文本转动作模型已通过 kimodo.cpp 移植到 CPU 上运行,无需 NVIDIA 的技术栈。kimodo.cpp 是一个开源的 GGML/C++ 实现,正迅速获得关注。

这太疯狂了 NVIDIA 的文本转动作模型现在无需 NVIDIA 的技术栈就能运行。 输入一句话。获得人类动作。在 CPU 上运行。 它被称为 kimodo.cpp —— NVIDIA Kimodo 的 GGML/C++ 移植版,仅四天就获得超过 470 颗星。 以下是疯狂的部分: 1. 文本输入,输出 SMPL-X22 旋转 + 根平移 2. 可在 CPU 或 Vulkan 上运行 —— 由你决定,使用你的硬件 3. 权重以 GGUF 格式提供,带有 SHA-256 验证的清单 4. DDIM 采样、扩散循环,在 C++ 中重写 5. CPU/Vulkan 一致性测试证明两个后端一致 无需 CUDA。 无需 Python。 无需 NVIDIA 账户。 在笔记本电脑 CPU 上与在 Vulkan GPU 上得到相同结果 —— 这就是一致性测试的目的。 它还提供: → C 和 C++ API(kimodo_generate 接受你的提示) → 一个 Go 演示服务器,带有提示历史,在 :8094 端口 → safetensors 转换工具 → 模糊测试 + 消毒器预设 而且没错:仅四天,Apache-2.0 许可证,每天更新。
查看原文
查看缓存全文

缓存时间: 2026/08/29 08:03

这太疯狂了

NVIDIA的文本转动作模型现在无需NVIDIA技术栈即可运行。

输入一句文本,就能生成人体动作——仅靠CPU实现。

这个项目名为kimodo.cpp,是NVIDIA Kimodo的GGML/C++移植版,诞生仅四天就已获得470+星标。

最核心的突破在于:

  1. 输入文本,输出SMPL-X22骨骼旋转数据+根节点平移参数
  2. 支持CPU或Vulkan双后端运行——硬件选择权在你手中
  3. 权重文件采用GGUF格式封装,配有SHA-256校验清单
  4. DDIM采样与扩散循环全部用C++重写
  5. CPU/Vulkan一致性测试证实双后端输出完全一致

无需CUDA环境 无需Python依赖
无需NVIDIA账户登录

笔记本CPU与Vulkan显卡输出相同数值——这正是通过一致性测试实现的。

同时提供: → C/C++ API接口(kimodo_generate函数直接处理提示词) → Go语言演示服务器(端口8094支持提示词历史记录) → safetensors格式转换工具 → 模糊测试与sanitizer预设方案

当然,项目采用Apache-2.0开源协议,四天内每日持续更新。

Vikas Gupta (@vicky_grok): 从大模型到智能体

大模型负责生成,智能体负责行动。

自主智能体融合了:

🧠 推理能力 🗂️ 记忆系统 🛠️ 工具调用 🔄 规划机制 👀 反馈闭环

这些要素共同驱动目标达成,而非简单响应提示。

相似文章