GPT-Live-1 现已登陆 API

YouTube AI Channels 模型

摘要

OpenAI 发布了 GPT-Live-1,这是一款全双工 AI 模型,可通过 API 进行实时语音对话,支持背景噪声处理,并集成后端推理模型。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/09/12 00:03

# GPT-Live-1 API 发布:实时语音对话 GPT-Live-1 是一款在 API 中新推出的全双工模型,专为自然、富有表现力的对话而设计。它能稳健地处理背景噪音和用户打断,同时将复杂任务委派给后端推理模型。 ## 简介与核心能力 OpenAI 宣布发布 GPT-Live-1 的 API。它被描述为一个全双工模型,意味着它可以同时监听和说话。这使得对话自然且富有表现力。该模型专门设计用于在嘈杂环境和用户打断(即用户在模型说话时插话)的情况下,依然能保持对话流畅进行。 它的设计目标是成为适用于所有场景的“语音版 ChatGPT”,提供可通过 API 集成到生产级应用中的对话式语音接口。 ## 关键特性 ### 全双工对话 其核心特性是处理打断的能力。用户可以在模型发言的任何时刻插话。模型可以“边听边说”。 ### 背景噪音抗扰能力 该模型设计为能够聚焦于用户语音,即使在嘈杂环境中也能保持清晰。在演示中,演示者故意播放了背景噪音,模型仍确认能清晰理解发言者。 ### 与后端模型集成 GPT-Live-1 并非独立处理所有任务。它与一个负责推理和工具调用的后端模型配对使用。这使得系统能够将行动委派给外部系统(如机器人和显示设备),而 GPT-Live-1 前端则维持自然的语音对话。 ## 定价与可用性 定价结构分为前端和后端组件: * **GPT-Live-1(前端模型):** 每分钟 5 美分($0.05/分钟)。 * **后端推理与工具服务:** 根据其自身使用情况另行计费。 此模型现已通过 OpenAI API 向开发者开放,以便他们将对话式语音体验构建到生产级应用中。 来源:YouTube - OpenAI: GPT-Live-1 is now in the API (https://www.youtube.com/watch?v=OSaP6bJoU44)

相似文章

GPT‑Live

Hacker News Top

OpenAI 宣布推出 GPT-Live,这是一种全新的全双工语音模型,通过允许同时收听和说话,实现更自然、实时的对话,后端模型为 GPT-5.5。

OpenAI 发布新语音模型,实现更自然的实时对话

TechCrunch AI

OpenAI 发布了新的全双工语音模型 GPT-Live-1 和 GPT-Live-1 mini,旨在实现更自然的实时对话,支持同时说话和聆听,在轮流发言和上下文处理方面有所改进,并取代 ChatGPT 中的 Advanced Voice Mode。