conversational-ai

标签

Cards List
#conversational-ai

@btaylor: 我很自豪地宣布我们与日本领先的电信和IT运营商软银(SoftBank)的合作关系,该运营商与日本各大企业建立了数十年的合作关系。

X AI KOLs Following · 2026-07-14 缓存

Sierra宣布与软银(SoftBank)达成战略合作,向日本企业提供其对话式AI平台,软银将担任独家销售合作伙伴,并在其自有品牌中采用该平台。

0 人收藏 0 人点赞
#conversational-ai

ChatGPT-Live vs Pi vs Lucy OS1 vs Gemini-Live:最适合交谈的AI助手?

Reddit r/artificial · 2026-07-11

对AI语音助手ChatGPT-Live、Pi、Lucy OS1和Gemini-Live的比较,重点关注哪个使用起来最自然,得出的结论是:随着智能水平的提高,对话质量正成为关键差异化因素。

0 人收藏 0 人点赞
#conversational-ai

以患者为中心的人工智能对话系统的复杂性

arXiv cs.AI · 2026-07-10 缓存

本文分析了2053次真实患者与聊天机器人的对话,发现沟通风格差异巨大,且能显著改变分诊结果。研究表明,能够模拟情绪状态和对话策略的患者模拟器所生成的对话,在图灵测试中几乎与真实对话无法区分。

0 人收藏 0 人点赞
#conversational-ai

OpenAI 发布新语音模型,实现更自然的实时对话

TechCrunch AI · 2026-07-08 缓存

OpenAI 发布了新的全双工语音模型 GPT-Live-1 和 GPT-Live-1 mini,旨在实现更自然的实时对话,支持同时说话和聆听,在轮流发言和上下文处理方面有所改进,并取代 ChatGPT 中的 Advanced Voice Mode。

0 人收藏 0 人点赞
#conversational-ai

ChatGPT升级后的语音模式更会闭嘴

The Verge · 2026-07-08 缓存

OpenAI发布GPT-Live-1,这是ChatGPT升级后的语音模式,打断用户更少,支持实时翻译,并能针对天气、体育等话题生成视觉背景。

0 人收藏 0 人点赞
#conversational-ai

从被动检索到主动记忆导航:学习将记忆作为结构化动作空间使用

arXiv cs.AI · 2026-07-08 缓存

NapMem是一个框架,将长期用户记忆视为结构化动作空间而非被动检索,通过多粒度记忆金字塔和强化学习训练代理进行记忆导航。实验表明,在记忆密集型任务上表现有竞争力。

0 人收藏 0 人点赞
#conversational-ai

我花了不少时间尝试让LLM制作出真正值得听的播客。难点不在模型本身。

Reddit r/artificial · 2026-07-07

一位开发者分享了让LLM生成的播客听起来更自然的技术,包括使用约束条件迫使产生分歧,以及在生成前预先编辑内容。

0 人收藏 0 人点赞
#conversational-ai

不要等待回复:通过主动思考实现响应迅速且深思熟虑的对话

arXiv cs.CL · 2026-07-07 缓存

提出一种主动思考框架,使大语言模型能在对话间隙预计算回复要素,在不牺牲质量的前提下提升交互效率。引入无需训练的基线方法,通过推测性持续思考预测未来状态,并在时间感知基准上进行评估。

0 人收藏 0 人点赞
#conversational-ai

定制化的双主持人AI对话播客,可随时打断提问

Reddit r/ArtificialInteligence · 2026-07-04

一款新工具可让你创建定制化的双主持人AI对话播客,并可实时打断提问。

0 人收藏 0 人点赞
#conversational-ai

@omarsar0:所以基本上,提示工程并没有消亡。言归正传,这是一篇很好的文章!如果你不提示智能体来填补你的不足,反之亦然,你会损失很多……

X AI KOLs Following · 2026-07-03 缓存

一条推文强调提示工程仍然具有相关性,推荐阅读如何通过头脑风暴和规划等技术来丰富与AI智能体的互动。

0 人收藏 0 人点赞
#conversational-ai

@_philschmid: “把时间变成白天。” 光线变化,阴影移动,天空改变。Gemini Omni Flash 可以通过对话编辑你的视频……

X AI KOLs Following · 2026-07-02 缓存

Google 的 Gemini Omni Flash 模型可以通过对话提示来编辑视频,使用 Interactions API 根据用户描述生成新片段。

0 人收藏 0 人点赞
#conversational-ai

学习用户感知召回:长期对话记忆中的个性化检索

arXiv cs.AI · 2026-07-02 缓存

本文介绍了Profile-guided Personalized Retrieval Optimization (PPRO),一种通过将用户画像融入记忆检索并利用强化学习优化检索的框架,增强了长期对话智能体的能力,在现有方法上实现了持续改进。

0 人收藏 0 人点赞
#conversational-ai

TRACE: 基于时间证据图的对话数据状态感知查询处理

arXiv cs.CL · 2026-07-02 缓存

本文提出 TRACE,一种查询处理框架,将对话数据建模为时间证据图,以支持对不断演进的用户状态进行状态感知推理,从而提高长对话问答中的时间推理和多跳推理能力。

0 人收藏 0 人点赞
#conversational-ai

基于参考的口语对话系统韵律与节奏评估

arXiv cs.CL · 2026-07-01 缓存

本文提出了一种基于参考的评估协议,用于评估语音到语音AI系统的韵律和节奏,通过匹配人类对话数据提供可解释的行为合理性检查。

0 人收藏 0 人点赞
#conversational-ai

IMCBench:面向图像基础医疗对话的多模态大语言模型基准

arXiv cs.AI · 2026-06-30 缓存

IMCBench是一个新的基准,用于评估多模态大语言模型在图像基础医疗对话中的表现,它将临床图像与合成患者档案配对。在安全性、准确性和不确定性方面的评估表明,即使是像Claude Opus 4.6这样强大的模型也存在安全问题,凸显了多维度评估的必要性。

0 人收藏 0 人点赞
#conversational-ai

从词汇到AI:面向低资源语言专业对话系统的结构化数据流水线

arXiv cs.CL · 2026-06-26 缓存

提出了一种系统方法论,将印地语WordNet转换为125万条指令-响应对,并利用LoRA对12B参数语言模型进行微调,展示了在低资源语言专业对话系统中教学效果的显著提升。

0 人收藏 0 人点赞
#conversational-ai

基于非暴力沟通约束减少大语言模型对话中的对话升级

arXiv cs.CL · 2026-06-26 缓存

本文探讨将非暴力沟通(NVC)原则作为轻量级提示约束,用于减少大语言模型在冲突倾向交互中的对话升级。在多个指令微调模型上的实验表明,NVC约束提示能持续降低对话升级,并稳定与高度抵抗用户的互动。

0 人收藏 0 人点赞
#conversational-ai

Dziri Voicebot:面向阿尔及利亚方言的端到端低资源语音对话系统

arXiv cs.CL · 2026-06-25 缓存

本文提出了一种模块化的端到端语音对话系统,适用于低资源的阿尔及利亚方言,集成了ASR、NLU、RAG和TTS,并使用了专用数据集和微调模型。

0 人收藏 0 人点赞
#conversational-ai

@bnicholehopkins: 今天上午我们的A轮融资公告获得了巨大支持,令我非常感动,包括Chris Metinko的精彩报道……

X AI KOLs Following · 2026-06-24 缓存

Coval宣布完成A轮融资,旨在构建用于测试和部署企业对话式AI代理的基础设施,其灵感来自自动驾驶测试的严谨性。

0 人收藏 0 人点赞
#conversational-ai

边说话边思考:面向响应式智能对话语音代理的推理时知识迁移

Hugging Face Daily Papers · 2026-06-23 缓存

本文介绍了一种对话语音代理系统,该系统使用轻量级设备端“Talker”模型立即开始响应,然后随着前沿大语言模型“Reasoner”知识的可用而将其融入,实现了7-19倍的首响应时间缩短,同时在笔记本电脑上达到接近前沿水平的性能。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈