@skalskip92: 可以用正负框来提示 Qwen3.8-Max,并利用它们生成新的检测结果,在……时非常有用

X AI KOLs Timeline 模型

摘要

SkalskiP 重点介绍了 Qwen3.8-Max,这是一个用于目标检测的视觉语言模型,可以通过正负框提示生成检测结果,在单个或多个提示下实现 60-80% 的 mAP,并且在不同类型的图像上表现良好。

Qwen3.8-Max 可以通过正负框进行提示,并利用它们生成新的检测结果 当我们想找的概念难以用文字描述时,这非常有用 使用单个框提示时 mAP 为 60% 使用多个框提示时 mAP 为 80% ↓ 更多示例 https://t.co/22NUG5Vfda
查看原文
查看缓存全文

缓存时间: 2026/08/05 08:22

Qwen3.8-Max 可以通过正负框提示来生成新的检测结果

当我们要寻找的概念难以用文字描述时,这非常有用

使用单个框提示时 mAP 为 60% 使用多个框提示时 mAP 为 80%

↓ 更多示例 https://t.co/22NUG5Vfda

SkalskiP (@skalskip92): Qwen3.8-Max 是最佳的目标检测 VLM

  • 卫星图像
  • 红外图像
  • 文档
  • 技术图纸
  • 手绘示意图
  • 拥挤场景
  • 小目标

↓ 看看其中一些惊人的示例

相似文章

Qwen3.6-Max-Preview

Product Hunt

阿里巴巴发布旗舰模型 Qwen3.6-Max-Preview,专为智能体编程任务优化。

Qwen3.7-Max:智能体前沿

Hacker News Top

Qwen3.7-Max 是一个专注于智能体能力的新 AI 模型发布,推动了自主 AI 智能体的边界。