实时全模态交互驱动的全身移动操作

Reddit r/singularity 模型

摘要

Unitree发布UnifoLM-OminiA-0.3,一个用于全身移动操作的单一AI模型,具备实时全模态交互,可实现自主家庭护理与健康任务。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/20 17:32

# Real-Time Omni-Modal Interaction Driven Whole-Body Mobile Manipulation **频道:** yogthos 来源: https://www.youtube.com/watch?v=IiNbFPOUrz8 ## 描述 Unitree UnifoLM-OminiA-0.3 — 单一模型处理多种居家照护与健康任务,具备全模态交互理解能力,全自主运行,稳定且抗干扰执行。

相似文章

ABot-M0.5: 统一移动与操作的世界动作模型

Hugging Face Daily Papers

ABot-M0.5 是一种针对移动操作的新型世界动作模型,通过时间粒度对齐、动作空间解耦和训练-测试一致性提升性能,在长时域和细粒度操作基准上达到了最先进水平。

iFLYTEK-Embodied-Omni Technical Report

arXiv cs.AI

本技术报告介绍了 iFLYTEK-Embodied-Omni,这是一个统一的多模态基础模型,采用脑-小脑协作架构和四阶段训练策略,联合建模视觉、语言和动作,用于具身智能体。

Xiaomi-Robotics-U0: 基于世界基础模型的统一具身合成

Hugging Face Daily Papers

小米机器人推出U0,这是一个380亿参数的多模态自回归模型,用于统一具身合成,将具身生成视为图像和视频生成的扩展。它在多个具身任务上取得了最先进的结果,超越了GPT-Image-2.0,并提高了真实世界操作的成功率。