标签
在被要求「构建一个你自己的体素版本」后,Fable 5.5 出人意料地生成了一个完整可探索的 3D 体素世界,展示了其在空间感知与世界生成任务中令人惊讶的涌现能力。
WorldAuditBench 是一个包含213个异常审计任务的基准,涵盖13个基于 Unreal Engine 5 / Three.js 构建的交互式3D环境,用于评估多模态智能体能否将动作与视觉推理有效耦合。前沿模型的成功率仅为6.6%–42.3%,远低于人类的83.4%,凸显出当前在证据收集与解读方面的局限性。
GPT-6 Astra,一个AI模型,因其在游戏、蛋白质设计、体育追踪和3D世界构建方面的多样应用而走红,并通过10个令人惊叹的案例加以凸显。
Anthropic 发布了 Claude Fable 5.1,这款AI模型正被用户迅速用于生成游戏、构建3D世界和创建各类模拟。
Figma Weave 集成了来自 @theworldlabs 的 Marble,实现了从文本、图像或视频输入创建和探索3D世界。
一项新的基准测试,用于评估多模态代理从自然语言构建3D开放世界的能力,显示GPT-5.5和Qwen3.8-Max得分低于60%,而一个开源30B模型通过强化学习实现了最佳性能。
本文提出了VibeWorlding,一个用于基准测试和训练多模态智能体的框架,使其能够从用户查询构建3D开放世界,并展示了强化学习如何提升开源模型以与闭源前沿模型竞争。