@rohanpaul_ai:一个非常酷的实时视频模型刚刚发布,用于交互式角色和世界
摘要
Vivix.AI 发布了 A1,一个面向交互式角色和世界的实时视频模型,通过小段连续片段同时生成音频与视频,从而实现无缝打断,以及带有持久状态的实时长对话。
查看缓存全文
缓存时间: 2026/10/01 04:14
一款非常酷的实时视频模型刚刚发布,用于生成可交互的角色和世界。
A1 不是先生成语音、再让身体去匹配语音。
在这里,音频和视频是作为一个整体从模型中生成的,以小段连续片段的形式输出。语音和动作属于同一个片段。
这一点在你切入(插话)时非常关键。在“先生成语音、再生成动画“的流水线中,中断意味着要同时停止两个系统,并祈祷它们能停在同一个位置。而这里只有一条流需要重定向。
用户可以和一个角色聊三十秒,也可以聊三十分钟;可以在它说了一半时打断它,改变话题,或者让它穿过房间。模型无法事先规划整个片段。
Vivix.AI (@VivixLabs_HQ): 创建你自己的角色。主导一切。实时进行。
介绍 A1 Playground + Agent:打造一个能说话、能行动、能陪你互动的实时 AI 角色。
创建你的角色:https://t.co/NtO2zveu5Q
他们的形象。他们的性格。他们的声音。由你选择。描述一下你心目中的角色,
相似文章
@omarsar0:实时 AI 角色现在可以全身运动,并且全程保持聆听。这个角色是在 V… 中构建的
Vivix Labs 推出 Vivix A1 模型和 A1 Playground + Agent,让实时 AI 角色具备全身动作、持续聆听、句子中途或动作中途被打断的能力,以及无需重置场景的持续物体交互。
@VraserX: 我认为人们低估了这一点。一旦AI角色能够四处移动、操控物体并以超低延迟做出响应,……
Vivix.AI推出了Vivix-A1,这是一个实时交互多模态模型,使AI角色能够移动、操控物体并以低延迟做出响应,超越了静态的说话面孔。
@rohanpaul_ai: AI视频正进入实时互动时代,MaineCoon如今在低延迟AI视频领域领先。@catnips_ai刚刚…
MaineCoon是一款22B参数的实时文生音频视频模型,在单张H100 GPU上可达47.5 FPS,支持低成本、长时长的流式生成,同步语音与画面,用于实时AI角色。
Mel AI 刚刚展示了一个视频原生 AI 角色的演示,这些角色能实时聊天、反应并响应摄像头上下文 [N]
Mel AI 展示了能够通过视频实时聊天、反应并响应视觉上下文的 AI 角色,超越了基于文本的角色聊天。
OpenAI的新语音模型不止于回话
OpenAI推出了三个新的实时音频模型,支持连续、多任务的语音交互,优先考虑长上下文推理、实时翻译和无缝工具使用。