标签
AICompanionBench 推出了首个公开可用的基准数据集,包含 2,123 条真实 AI 伴侣对话,并按九个安全风险类别进行标注,用于评估 20 个 LLM 作为安全裁判的表现。结果显示,强模型能较好地处理显性有害内容,但在操控等细微风险的识别以及对无害对话的误判问题上仍存在明显不足。
本文介绍了一项结构化实验,比较了AI外呼代理(LuMay Voice Agent、Voxentis和开源堆栈)在真实线索转化中的表现,突出了它们在工作流稳定性、对话适应性和系统控制方面的各自优势。
介绍DMF,一种用于对话式AI代理的确定性记忆框架,它用经典NLP和数学评分取代了基于LLM的压缩,实现了与Mem0相当的准确度,同时内存准备使用零token,总体token使用量减少高达242倍。
对AI语音模型中半双工与全双工架构的分析,讨论了重叠、反馈和打断等关键特性,这些特性使语音助手听起来很机械。
YouTube推出全新对话式搜索功能「Ask YouTube」,允许用户提出复杂的搜索问题并通过追问细化需求。
Orvera AI(前身为CallBotics)进行品牌重塑,以反映企业需求从简单的语音机器人转向生产级AI代理系统,这些系统处理工作流执行、治理和多渠道编排。
Sesame是一家由Oculus创始人创立的AI初创公司,近日推出了iOS公开预览版应用,其具备类人语音代理,能够进行自然对话、并行搜索,并拥有四种不同的AI个性。
Adobe的Firefly AI Assistant是一款集成在Photoshop和Illustrator等设计应用中的对话代理,旨在简化繁琐工作,同时让用户保留创意控制权。测试版显示前景可期但仍不完美,采用透明、分步的编辑方式。
本文介绍了MeDial-Speech,一个用于口语语言处理的机器人-患者与医生-患者医疗对话数据集,并在句子选择基准上评估了三个大型语言模型,发现Claude Sonnet 4最为准确。
本文重点介绍了AI智能体如何通过消除学习工具的需求彻底改变软件,并介绍了Spoki——一个AI对话平台,该平台管理整个客户旅程(涵盖WhatsApp、短信和语音AI),取代了传统的CRM系统。
一个视频演示了AI通过分析用户搜索历史生成算法,能够提前预测并回答用户即将提出的问题,展示了令人惊讶的预测能力。
讨论用于视频制作的对话式AI副驾方法,以Higgsfield超级计算机和Invideo Agent One为例,并质疑这种编排工作流程是否比直接使用底层模型更有价值。
本文批判了ReAct和Workflow agents在企业客户服务中的不足,指出了诸如缺乏可控性和僵化等问题,然后介绍了TeliChat,这是一种代码优先的对话式代理,它将LLM任务(意图识别、自然语言生成)与代码驱动的业务逻辑分离开来,以提高可追溯性和可调试性。
本文提出了一种基于自定进度课程学习的即插即用模块,用于增强多模态对话情感识别中的模态平衡,在IEMOCAP和MELD数据集上实现了F1分数的一致提升。
文章认为,近期AI最重要的转变并非智力,而是记忆——AI系统记住用户偏好、习惯和进行中的项目,从单纯的工具转变为上下文感知的助手。
本文介绍了一项实验研究,探讨与基于问答的辅助相比,对话式XAI助手是否能提升用户在预测准确性、模型理解和错误识别方面的表现,初步结果显示无显著性能差异。
Miso Labs 发布了 Miso TTS 8B,这是一个基于 Sesame CSM 架构和类似 Llama 3.2 骨干网络的文本转语音模型,旨在生成高质量对话语音及实现语音延续。
Google 的 AI Mode 一年前在美国推出,目前全球月活跃用户已超过十亿,正在改变搜索行为:查询变得更长,语音和图片搜索增长,计划和头脑风暴类查询增多。
谷歌宣布推出Gmail Live,这是一项由Gemini驱动的对话式AI功能,用户可以用自然语言提问来查找收件箱内容,而不是使用传统搜索。该功能在Google I/O上推出,旨在让查找邮件信息变得更加容易。