@AdinaYakup: 这是新动态 👀 @Alibaba_Qwen 刚刚在 @huggingface 上发布了一个用于自动驾驶的开放 VLM 基础模型 - 4B / A…

X AI KOLs Following 模型

摘要

阿里巴巴Qwen在Hugging Face上发布了一款开源的4B参数视觉语言模型,专为自动驾驶设计,集成了3D检测、占用预测和BEV功能,同时保留了强大的视觉语言能力。

这是新动态 👀 @Alibaba_Qwen 刚刚在 @huggingface 上发布了一个用于自动驾驶的开放 VLM 基础模型 - 4B / Apache 2.0 - 3D检测 + 占用 + BEV,一体化 - 强大的驾驶VQA,同时保持VL能力 https://t.co/jgXJylGPU9
查看原文
查看缓存全文

缓存时间: 2026/09/09 09:45

这是新动态 👀

@Alibaba_Qwen 刚刚在 @huggingface 上发布了一个面向自动驾驶的开源视觉语言基础模型。

  • 4B参数 / Apache 2.0协议
  • 3D检测 + 占用网络 + 鸟瞰图,三合一架构
  • 在保持视觉语言能力的同时,具备强大的驾驶问答能力 https://t.co/jgXJylGPU9

相似文章

@julien_c: 开源,wen?

X AI KOLs Following

Julien C 询问阿里巴巴的 Qwen3.7-Plus 是否开源发布,这是一个统一视觉与语言的多模态智能体模型。

Qwen-Drive (GitHub 仓库)

TLDR AI

Qwen-Drive-1.0 是一个用于自动驾驶的视觉语言基础模型,它在一个统一框架中整合了3D感知、视觉问答和运动规划,在基准测试中表现出色。