voice-model

标签

Cards List
#voice-model

@sama:我现在和 ChatGPT 说话比打字还多,新语音模型真的跨越了一个门槛

X AI KOLs · 2026-07-16 缓存

Sam Altman 发推文说,他现在和 ChatGPT 说话比打字还多,并指出新语音模型在质量上跨越了一个门槛。

0 人收藏 0 人点赞
#voice-model

GPT新语音模型简直太疯狂了。

Reddit r/singularity · 2026-07-11

OpenAI 的新 GPT 语音模型实现了高度逼真、低延迟的实时语音对话,并具备情感表达能力,标志着 AI 语音交互的一次重大飞跃。

0 人收藏 0 人点赞
#voice-model

@OpenAI:GPT-Live 现已全面推送给 Go、Plus 和 Pro 方案的所有 ChatGPT 用户。免费用户的推送正在进行中。更新…

X AI KOLs Following · 2026-07-09 缓存

OpenAI 已将新一代用于自然人机交互的语音模型 GPT-Live 全面推送给 Go、Plus 和 Pro 方案的 ChatGPT 用户,免费用户的推送正在进行中。

0 人收藏 0 人点赞
#voice-model

Simba 语音代理

Product Hunt · 2026-07-08

Simba 3.2,号称全球排名第一的语音模型,现已驱动新的语音代理。

0 人收藏 0 人点赞
#voice-model

GPT‑Live

Hacker News Top · 2026-07-08 缓存

OpenAI 宣布推出 GPT-Live,这是一种全新的全双工语音模型,通过允许同时收听和说话,实现更自然、实时的对话,后端模型为 GPT-5.5。

0 人收藏 0 人点赞
#voice-model

@FinanceYF5: OpenAI 新语音模型 Bidi 1 首测曝光 双向语音设计,你说的同时它在听,中途打断可立刻切换任务,不再因你停顿就抢话。 还能实时翻译,上下文记忆也比现在的 Advanced Voice 强很多。 目前已小范围推送,ChatGPT …

X AI KOLs Following · 2026-06-25 缓存

OpenAI 新语音模型 Bidi 1 首测曝光,支持双向语音设计、实时翻译和更强的上下文记忆,目前已小范围推送至 ChatGPT。

0 人收藏 0 人点赞
#voice-model

六月延迟5.6

Reddit r/singularity · 2026-06-23

多个AI模型发布延迟:GPT-5.6预计推迟至7月中旬,DeepMind的3.5 Pro延期发布,而OpenAI的Bidi语音模型和面向企业的Claude Sonnet 5取得进展。

0 人收藏 0 人点赞
#voice-model

OpenAI计划发布GPT-Bidi-1,其下一代语音模型

Reddit r/singularity · 2026-06-17

OpenAI计划发布GPT-Bidi-1,其下一代语音模型,可同时听和说,处理中断,并实现更自然的对话。

0 人收藏 0 人点赞
#voice-model

DramaBox - 基于LTX 2.3的最具表现力语音模型

Reddit r/LocalLLaMA · 2026-05-13

DramaBox是一个基于LTX 2.3的高度表现力语音模型,由Resemble AI发布,其开源代码和模型可在GitHub和Hugging Face上获取。

0 人收藏 0 人点赞
#voice-model

@seclink: OpenAI 发布了 GPT-Realtime-2,这是其迄今为止最智能的语音模型。 该模型具备 GPT-5 级别的推理能力、128,000 个 token 的上下文窗口,并支持调节“投入程度”以实现更自然的对话体验。 它可与 GPT-R…

X AI KOLs Following · 2026-05-08

OpenAI发布了GPT-Realtime-2语音模型,具备GPT-5级别的推理能力和128,000 token上下文窗口,支持实时翻译70多种语言到13种输出语言,在Big Bench Audio Intelligence评测中达到96.6%准确率,Greg Brockman称其为语音翻译领域的里程碑。

0 人收藏 0 人点赞
#voice-model

Improved Intelligence with GPT-Live

YouTube AI Channels · 2026-07-15 缓存

OpenAI 发布了新的语音模型 GPT-Live,能够以自然的方式进行多任务对话,并实时执行复杂的规划,例如安排东京-迪拜-夏威夷的一日游。

0 人收藏 0 人点赞
#voice-model

Background Robustness with GPT-Live

YouTube AI Channels · 2026-07-15 缓存

OpenAI 展示了新语音模型在嘈杂环境下的背景鲁棒性,能准确识别对话对象、理解上下文,并允许用户自然打断,实现流畅的多人互动。

0 人收藏 0 人点赞
#voice-model

Listening & Speaking with GPT-Live

YouTube AI Channels · 2026-07-09 缓存

OpenAI 展示了新语音模型 GPT-Live 的实时同声传译与对话能力,能够同时听和说,并在翻译与聊天之间无缝切换。

0 人收藏 0 人点赞
#voice-model

Natural Conversations with GPT-Live

YouTube AI Channels · 2026-07-09 缓存

OpenAI 展示新版语音模型在个性化和自然度上的突破,能够进行自然的头脑风暴式对话,表现出共情和适时插话能力,接近人类对话节奏。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈