标签
一位开发者使用Home Assistant Voice PE和OpenAI Realtime构建了OpenClaw Voice,这是一个专用语音接口,可实现亚秒级智能家居控制、基于记忆的查询、拨打电话和带有语音反馈的长时间运行任务。整个技术栈已开源。
Whispera 是一个基于 VoxCPM 的 Windows 本地实时语音助手,集成了 SenseVoice ASR、llama-server 本地 LLM 推理、VoxCPM 流式 TTS 和 Mem0 长期记忆,完全离线运行。
亚马逊宣布推出Alexa的智能代理版本,具备长期记忆功能,并整合了超过1000个应用,增强了其作为个人AI助手的能力。
探讨了在没有GPU的情况下,在CPU上使用Qwen3-ASR和Kokoro-TTS ONNX模型运行语音助手的性能,测量响应时间。
Athena 是一款完全离线、隐私优先的语音助手,完全运行在本地硬件上,结合了多种AI模型用于语音识别、语言理解和情感感知语音合成,具备长期记忆和可中断性。
Google Home Speaker 上手评测:音质与设计获赞,但触控不灵敏,光环隐藏较深
提出了绑定子空间(BSU),一种表示级框架,用于在端到端口语理解模型中隔离和削弱意图条件方向,以防止能力持续性——即抑制某个意图时,强制前缀仍能生成槽。该方法降低了强制前缀的可恢复性,同时保持了在SLU基准测试上的保留性能。
Google Home 将进行更新,通过衣物和体型增强面部识别能力,现在还能在视频事件描述中识别特定声音,如狗叫声或警报声。
Amazon正在印度测试其生成式AI助手Alexa+的印地语版本,邀请用户加入测试计划,以便在广泛推出前优化体验。
《连线》杂志对搭载于 iOS 27 的苹果 Siri AI 进行上手体验,发现其由谷歌 Gemini 和 Apple Intelligence 驱动,更具对话性、更个性化且更实用,计划于今年晚些时候公开发布。
谷歌发布售价99.99美元的Google Home Speaker,这是多年来首款独立智能音箱,搭载Gemini AI,支持自然语言和多步骤指令,高级功能需每月10美元订阅。
Google的Gemini TTS现在支持流式音频生成,开发者可以构建即时响应的语音应用,无需等待完整音频输出。
谷歌终于推出了其全新的搭载Gemini的Home音箱,距上一款智能音箱已有六年。新产品提供了更佳的自然语言理解、多指令处理能力以及重新设计的外观。预购将于6月17日开始,6月25日正式发售,售价100美元。
The Verge在macOS 27 Golden Gate测试版上使用Siri AI的头24小时,发现它仍然有限,但在启动应用等基本任务上展现了潜力,同时缺乏更深层次的应用集成。
苹果在其申请豁免某些欧盟数字法规被拒后,决定不在欧盟推出Siri,这影响了其语音助手在该地区的推广。
苹果在WWDC上宣布了“Siri AI”,这是一个更会话式的语音助手,与应用和个人上下文深度集成,将于今年秋季与谷歌驱动的AI模型更新一同推出。
Wired的2026年更新指南,涵盖了Amazon Alexa、Google Assistant和Apple Siri生态系统,重点推荐了Amazon Echo Dot Max、Google Nest Hub Max、Google Nest Audio和Apple HomePod Mini等顶级产品。
Nvidia CEO 黄仁勋在 Computex 2026 上宣布,公司正在规划 N2X 和 N3X 芯片,设想未来的《星际迷航》式 AI 计算机,用户可以与它们对话并远程控制。