@AdinaYakup: 这是新动态 👀 @Alibaba_Qwen 刚刚在 @huggingface 上发布了一个用于自动驾驶的开放 VLM 基础模型 - 4B / A…
摘要
阿里巴巴Qwen在Hugging Face上发布了一款开源的4B参数视觉语言模型,专为自动驾驶设计,集成了3D检测、占用预测和BEV功能,同时保留了强大的视觉语言能力。
这是新动态 👀
@Alibaba_Qwen 刚刚在 @huggingface 上发布了一个用于自动驾驶的开放 VLM 基础模型
- 4B / Apache 2.0
- 3D检测 + 占用 + BEV,一体化
- 强大的驾驶VQA,同时保持VL能力 https://t.co/jgXJylGPU9
查看缓存全文
缓存时间: 2026/09/09 09:45
这是新动态 👀
@Alibaba_Qwen 刚刚在 @huggingface 上发布了一个面向自动驾驶的开源视觉语言基础模型。
- 4B参数 / Apache 2.0协议
- 3D检测 + 占用网络 + 鸟瞰图,三合一架构
- 在保持视觉语言能力的同时,具备强大的驾驶问答能力 https://t.co/jgXJylGPU9
相似文章
@AdinaYakup: Open source summer party is not over yet https://huggingface.co/Qwen/Qwen3.8-27B…
Qwen3.8-27B, a compact 27B dense vision-language model with flexible thinking control and long-context support, is released as the most capable Qwen open model to date, available soon via Hugging Face and Qwen Cloud.
@julien_c: 开源,wen?
Julien C 询问阿里巴巴的 Qwen3.7-Plus 是否开源发布,这是一个统一视觉与语言的多模态智能体模型。
Qwen-Drive (GitHub 仓库)
Qwen-Drive-1.0 是一个用于自动驾驶的视觉语言基础模型,它在一个统一框架中整合了3D感知、视觉问答和运动规划,在基准测试中表现出色。
Qwen-Drive-1.0:迈向自动驾驶视觉语言基础模型的初步探索
Qwen-Drive-1.0是一款面向自动驾驶的视觉语言基础模型,通过共享表征与分阶段训练,统一了三维感知、视觉问答和运动规划能力。
@sgl_project: 小型模型之王回归了!来自@Alibaba_Qwen的Qwen3.8-27B已经开源,SGLang已经实现了首日支持:-…
Qwen3.8-27B,一个来自阿里巴巴的270亿参数多模态AI模型,现在已经开源,并在SGLang中提供了首日支持,提供高推理速度和在编码与办公任务上的卓越性能。