标签
一条推文批评AI生成的3D场景不过是噱头,并推荐TopviewAI的3D Shot Composer工具,以实现更精确的场景指导和控制。
SpatialAct是一个新的基于模拟器的基准,用于探索VLM智能体是否能在多轮反馈设置下进行连贯的空间推理并将其转化为3D环境中的行动。实验揭示了一个显著的推理到行动差距:当前的VLM尽管在孤立推理任务上表现良好,但难以维持空间信念并产生可靠的行为。
用户展示了 Qwen3.6-35B 根据截图重建等距房间场景的能力,突出了该模型在 3D 场景生成上的表现,家具细节和纹理处理均有改进。