visual-ai

标签

Cards List
#visual-ai

@omarsar0: 不确定Space Bunny是什么模型,但我印象深刻。我这周有机会测试了它。它在OpenCode中免费提供……

X AI KOLs Timeline ↗ · 4天前 缓存

本文评测了Space Bunny,一个具有强大视觉理解和编码能力的AI模型,在图像到代码、3D建模和创意原型设计等任务中表现出色,可在OpenCode中使用。

0 人收藏 0 人点赞
#visual-ai

使用视觉人工智能研究城市的承诺与风险

MIT News — Artificial Intelligence ↗ · 5天前 缓存

MIT Senseable City Lab的研究人员在一本新书中讨论了使用视觉AI分析城市环境的方法,强调了其在城市规划中的潜力,同时探讨了隐私和公平性方面的担忧。

0 人收藏 0 人点赞
#visual-ai

@NVIDIAAI: 视觉AI需要识别场景,理解发生了什么,并预测接下来可能发生什么。对于AI City挑战……

X AI KOLs Timeline ↗ · 2026-09-08 缓存

在ECCV 2026的AI City挑战赛中,展示了开发稳健视觉AI系统的获胜者,其中顶级解决方案在视频预测中使用NVIDIA Cosmos世界基础模型,用于场景理解和预测等任务。

0 人收藏 0 人点赞
#visual-ai

我今年见过的'Image to Video'最佳使用案例

Reddit r/singularity ↗ · 2026-08-27

这篇文章突出了今年迄今为止最令人印象深刻的'Image to Video'技术应用。

0 人收藏 0 人点赞
#visual-ai

前Meta科学家希望将视觉AI引入工厂车间

TechCrunch AI ↗ · 2026-08-26 缓存

Perceptron,一家由前Meta科学家创立的初创公司,推出了Isaac 0.5,这是一个开放权重的视觉AI模型,旨在帮助机器人在仓库和工厂等工业环境中感知、推理和行动。

0 人收藏 0 人点赞
#visual-ai

@heyshrutimishra: 个人视觉助手来了。相机一直只能捕捉眼前所见。NewEyes 的构建目的是理解……

X AI KOLs Following ↗ · 2026-08-04 缓存

Collov Labs 出品的 NewEyes AI 是一款视觉助手,能够理解相机输入的上下文——搭配服装、计算卡路里、提醒植物养护——而不仅仅是捕捉像素。

0 人收藏 0 人点赞
#visual-ai

@DanKornas: 当每个模型和参数都藏在不同的脚本后面时,视觉AI工作流变得难以管理。ComfyUI是一个……

X AI KOLs Timeline ↗ · 2026-07-23 缓存

ComfyUI是一款开源的、基于节点的AI创作引擎,让构建者和视觉专业人士无需编码即可设计复杂的生成工作流,支持图像、视频、音频和3D,具备部分重新执行能力和广泛的模型支持。

0 人收藏 0 人点赞
#visual-ai

前DeepMind研究员在产品发布前以3亿美元估值完成种子轮融资

TechCrunch AI ↗ · 2026-07-16 缓存

前DeepMind研究员Andrew Dai为其视觉AI初创公司Elorian以3亿美元估值完成了5500万美元的种子轮融资,并讨论了融资策略以及视觉理解在AI中的重要性。

0 人收藏 0 人点赞
#visual-ai

唉,我怀念那些AI图像一眼就能识别的日子

Reddit r/ArtificialInteligence ↗ · 2026-07-09

一则怀旧评论,怀念AI生成图像曾能轻易与真实图像区分开来的时代,并突出了视觉AI的日益成熟。

0 人收藏 0 人点赞
#visual-ai

@FinanceYF5: 视觉AI最大的转变,不是像素更好了—— 而是顶级工具已经停止生成「最终输出」,转而生成背后的「源代码」。 a16z 合伙人 Yoko Li :小红书最值得读的视觉AI分析

X AI KOLs Following ↗ · 2026-06-06 缓存

视觉AI领域发生重大转变,顶级工具不再直接生成最终输出,而是生成其背后的源代码,a16z合伙人Yoko Li对此进行了深入分析。

0 人收藏 0 人点赞
#visual-ai

视觉AI的下一个前沿是代码(11分钟阅读)

TLDR AI ↗ · 2026-06-03 缓存

文章认为,视觉AI的下一个前沿是生成代码(例如SVG、HTML/CSS、React组件),而非原始像素,从而实现了可编辑性、迭代性以及与专业设计和开发工作流程的集成。

0 人收藏 0 人点赞
#visual-ai

不是每天都有机会和迈克尔·奥维茨、@AnjneyMidha 以及 @bfl_ai 团队一起进入马丁·斯科塞斯的办公室……

X AI KOLs Following ↗ · 2026-06-02 缓存

马丁·斯科塞斯加入 Black Forest Labs 担任顾问,并使用 FLUX 进行故事板制作,展示了 AI 在视觉创意中的作用。

0 人收藏 0 人点赞
#visual-ai

opus 4.8 仍然非常盲目 - EyeBench-V3 视觉基准测试(类似于 IBench)

Reddit r/singularity ↗ · 2026-06-01

EyeBench-V3 视觉基准测试评估了 Claude Opus 4.8,发现它仍然无法完成基本视觉任务,这与 IBench 类似。该基准测试是通过 Adonis Singh 的 Twitter 帖子介绍的。

0 人收藏 0 人点赞
#visual-ai

拿着火腿电台的浣熊在哪?(ChatGPT Images 2.0)

Simon Willison's Blog ↗ · 2026-04-21 缓存

OpenAI 发布 ChatGPT Images 2.0,号称实现 GPT-3 到 GPT-5 的飞跃;Simon Willison 用“找浣熊+火腿电台”的 Where’s Waldo 式提示词,把它与 gpt-image-1、Google Nano Banana 2 和 Pro 对比测试,捉迷藏成功率参差不齐。

0 人收藏 0 人点赞
#visual-ai

用 ChatGPT Images 2.0 一键生成幻灯片与信息图

YouTube AI Channels ↗ · 2026-04-22 缓存

开启“思考”模式的 ChatGPT Images 2.0,能把 1,000 字提示或 70 页 PDF 直接变成可立即使用的信息图、幻灯片及学术海报,无需手动调整。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈