标签
Google DeepMind 发布了 Gemini Omni 1.1 Flash,这是一款更新的生成式视频AI模型,具有增强的创意控制、场景扩展和更快的原型制作功能,现在可通过 API 在 Google AI Studio 中使用。
OpenAI 推出了 GPT-Realtime-2,将 GPT-5 级别的推理能力集成到实时语音 API 中,使语音助手能够在对话过程中进行实时思考和解决问题。