标签
这条推文分享了 11 个 AI 驱动的网站,涵盖解决问题、研究、音乐生成、背景去除、视频编辑等任务。
推荐一款免费开源的 macOS 工具 Maya,可将 iPhone 屏幕录制包装成带有设备边框、动画和缩放效果的精美宣传视频,对标 matte 等付费产品。
EffectLearner 是一个面向真实世界视频物体移除的语义推理增强框架,它将基于 VLM 的物体-效果推理器与基于 DiT 的视频擦除器相结合,并引入了 EffectWorld 数据集以处理复杂的物体引发效果。
Crayotter 引入了组相对偏好反向传播(GRPB),一种训练长视界视频编辑智能体的方法,利用任务内偏好排序而非全局标量奖励。由此产生的 9B 模型在 AgenticVBench 上超越了多个专有系统。
JoyAI-Video-Edit 是一个具有 160 亿参数的自回归扩散框架,用于实时、开放式视频编辑,可在单个 NVIDIA B200 GPU 上实现约 30 FPS 的 720p 编辑。
Stan 联合创始人兼CEO John Hu 在 Trailblazers 上表示,他的AI剪辑师 Stanley 的视频剪辑质量已经达到其人类团队的80%,凸显出AI剪辑正成为实际制作中的实用基准。
Google Gemini 现在可以通过单个对话编写脚本、规划并编辑整个视频,提供可替代创作者手动时间线和剪辑工作的提示词。
VideoAgent 是一个一体化的开源框架,用于全面视频智能,通过统一的智能体工作流结合理解、编辑和创意生成。
MiniMax H3 在 Artificial Analysis 视频编辑排行榜上位居榜首,提供基于指令的多模态输入编辑现有片段,并具有竞争力的定价,同时计划开源权重供商业使用。
本文介绍了TriLayer,一个包含前景-背景-合成三元组的大规模视频数据集,以及DBL-Diffusion,一个用于显式分层视频表示的双分支扩散框架,实现了高保真度的对象插入和层分解。
ComfyUI-OpenCut is a new open-source plugin that integrates a full-featured video editor directly into ComfyUI, allowing multi-track editing, keyframes, effects, and real-time preview in the browser without server-side processing.
一位开发者开源了一个由10个AI智能体组成的系统,可从播客片段自动生成YouTube Shorts,包括转录、剪辑、字幕、排程,并设有一个质量检测智能体。
X(原Twitter)已在iOS上推出视频缩略图功能,用户可上传图片或选择视频帧,并使用内置照片编辑器进行自定义。
FlowMimic 提出了一种方法,利用像素对扭曲流场实现跨视频和图像模态的无掩码视觉编辑与生成,能够从图像编辑样本实时生成视频编辑数据,并通过模仿损失对齐模态能力。