@skalskip92: 可以用正负框来提示 Qwen3.8-Max,并利用它们生成新的检测结果,在……时非常有用
摘要
SkalskiP 重点介绍了 Qwen3.8-Max,这是一个用于目标检测的视觉语言模型,可以通过正负框提示生成检测结果,在单个或多个提示下实现 60-80% 的 mAP,并且在不同类型的图像上表现良好。
Qwen3.8-Max 可以通过正负框进行提示,并利用它们生成新的检测结果
当我们想找的概念难以用文字描述时,这非常有用
使用单个框提示时 mAP 为 60%
使用多个框提示时 mAP 为 80%
↓ 更多示例 https://t.co/22NUG5Vfda
查看缓存全文
缓存时间: 2026/08/05 08:22
Qwen3.8-Max 可以通过正负框提示来生成新的检测结果
当我们要寻找的概念难以用文字描述时,这非常有用
使用单个框提示时 mAP 为 60% 使用多个框提示时 mAP 为 80%
↓ 更多示例 https://t.co/22NUG5Vfda
SkalskiP (@skalskip92): Qwen3.8-Max 是最佳的目标检测 VLM
- 卫星图像
- 红外图像
- 文档
- 技术图纸
- 手绘示意图
- 拥挤场景
- 小目标
↓ 看看其中一些惊人的示例
相似文章
@skalskip92: Qwen3.8-Max 是最佳目标检测 VLM - 卫星图像 - 红外图像 - 文档 - 技术图纸 - 手…
一条推文声称 Qwen3.8-Max 是最佳目标检测 VLM,在卫星、红外、文档和手绘图像方面表现出色,并分享了示例。
Qwen3.8-Max:编程与协作的新标杆
Qwen3.8-Max 为 AI 模型的编程与协作能力树立了新标杆。
Qwen3.6-Max-Preview
阿里巴巴发布旗舰模型 Qwen3.6-Max-Preview,专为智能体编程任务优化。
Qwen3.7-Max:智能体前沿
Qwen3.7-Max 是一个专注于智能体能力的新 AI 模型发布,推动了自主 AI 智能体的边界。
Qwen3.8-Max:编程与协作的新标杆(25分钟阅读)
Qwen 3.8-Max,一个拥有2.4万亿参数的模型,现已正式可用,开放权重将于下周发布,在编程、工作、研究和长期任务等方面带来全面改进。