标签
OpenAI建立了一种支持长期研究投注的文化,例如像GPT-live系列这样的全双工模型,正如Kundan Kumar所强调的。
OpenAI 宣布推出 GPT-Live,这是一种用于实时音频的新架构和技术栈,能够在说话的同时聆听,通过连续音频流实现更深入的推理和工具使用,且不会打断对话。
OpenAI 描述了如何构建 GPT-Live,一个全双工实时语音 AI 系统,它消除了轮流检测器,实现了自然的连续对话。文章详细介绍了六个月内推理、上下文管理和媒体传输方面的架构改进。
OpenAI 为其 ChatGPT 桌面应用增加了语音模式,该模式由新的 GPT-Live 模型驱动,允许用户免提控制 AI 代理并执行任务。此次更新还支持 macOS 上的计算机使用技巧和 Appshots。
OpenAI在桌面端推出了ChatGPT语音功能,支持语音控制电脑和协调多个代理,基于GPT-Live,即日起全球上线。
OpenAI将GPT-Live的全双工语音控制集成到Codex和ChatGPT桌面应用中,实现免提智能编码与多线程任务执行。
OpenAI 已在桌面应用中推出 ChatGPT Voice,允许用户通过语音控制电脑并指挥多个智能体,该功能由 GPT-Live 提供支持。正在向 macOS 和 Windows 上的付费计划全球推出。
本文介绍如何将GPT-Live口语练习中遇到的卡壳点自动转化为Anki卡片,通过间隔复习巩固表达,形成“练习→提取→复习”的闭环,提升口语学习的效率与可追踪性。
OpenAI展示了GPT-Live的改进,突出了其在实时处理多项任务(如查询航班、天气和制定行程)的同时保持对话的能力。
这篇手把手教程详细介绍了如何使用OpenAI的GPT-Live进行英语口语练习,包括测试水平、场景练习和复盘步骤,提供了可直接复制的提示词。
用户分享使用GPT Live和SentiaRead辅助雅思口语和阅读练习的体验,认为AI工具能替代培训机构。
来自The Verge的Installer新闻通讯的科技与生活推荐汇总,包括iFixit Megalodon螺丝刀套件、Nothing Earbuds 3A耳机、Ugmonk Analog卡片以及OpenAI的GPT-Live AI语音模式。
OpenAI 宣布推出 GPT-Live,这是一种新一代的语音模型,用于实现自然的人机交互,即将在 ChatGPT 中推出,并诚邀设计合作伙伴测试 API。
GPT-Live 作为 AI 口语老师,能实时纠正语法和不地道表达,可能对英语口语教学产生重大影响。
OpenAI 宣布推出 GPT-Live,这是一种新一代的语音模型,旨在实现自然的人机交互,并已在 ChatGPT 中逐步推出。
OpenAI 已将新一代用于自然人机交互的语音模型 GPT-Live 全面推送给 Go、Plus 和 Pro 方案的 ChatGPT 用户,免费用户的推送正在进行中。
OpenAI 终于升级了驱动 ChatGPT 语音模式的模型,推出了 GPT‑Live。它能够在保持对话流畅的同时,将复杂任务委托给 GPT‑5.5。新模型的能力远超此前基于 GPT‑4o 的语音模式。
OpenAI 发布了新的全双工语音模型 GPT-Live-1 和 GPT-Live-1 mini,旨在实现更自然的实时对话,支持同时说话和聆听,在轮流发言和上下文处理方面有所改进,并取代 ChatGPT 中的 Advanced Voice Mode。