哇,图像识别能力相当不错

Reddit r/ArtificialInteligence 新闻

摘要

一位用户通过关于追踪冰洞的特定提示,展示了令人印象深刻的图像识别能力,突显了模型的视觉理解水平。

第一个和第二个图像的提示原文:​ 1. 洞在哪里?仅用虚线闭合曲线精确描绘冰洞的轮廓。排除瓶口。生成一张图片来展示,不要对图像进行不必要的修改。​ 2. 我说的是洞,不是冰
查看原文

相似文章

用图像思考

OpenAI Blog

OpenAI 发布了 o3 和 o4-mini 模型,这些模型能够在链式思维过程中对图像进行推理,通过裁剪和缩放等原生图像操作工具实现视觉理解,无需额外的专用模型。这些模型在包括 STEM 问题、图表阅读和视觉搜索任务在内的多模态基准上达到了最先进的性能。

极其精准的新图像模型

Reddit r/singularity

一位用户在 AIArena 上发现了一个名为 'autobear' 的匿名图像生成模型,据称能生成高度准确的信息图,但其来源和身份未知。