标签
这条推文介绍了LingBot-World-Infinity,一个开放权重的视频生成模型,它采用一种训练技术来从错误中恢复,从而能够生成跨越多个场景的连贯的1小时视频。
Robust-U1 是一个框架,通过监督微调、双奖励强化学习和联合多模态推理,使多模态大语言模型能够自我修复受损的视觉内容,在鲁棒性基准测试上达到了最先进水平。