我们不在奇点时刻,而是处于Dexter时刻。
摘要
一位用户报告了Google 3.1 TTS预览模型中的重大错误,该模型在音频输出中编造内容,引发了人们对AI在关键应用中可靠性的担忧。
使用Google 3.1 TTS预览模型做了一些认真的工作。基本上任务是将一些短段落转换为音频。模型从初始测试听起来很棒,自然且有多角色等。然后进行了批量转换。后来我们发现了这个模型的严重错误,Google 3.1 TTS在音频中编造了许多内容!这是史上最糟糕的失误。它来自Buffet投资的最大的AI公司。我们本应坚持开源编程方式而不是AI模型。所以最终我们意识到我们不在奇点时刻,而是处于Dexter时刻。你可能不知道Dexter。他是一个连环杀手。他看起来像是最伟大、最聪明的同事、儿子、父亲等,但在晚上杀死坏人。我认为AI在这个阶段是相似的。他可能是你遇到过的最好的家伙,以最低成本帮助人类做难以置信的事情,但它在晚上杀人。TTS错误可能没那么糟糕。你能想象这发生在药物测试、医院处方和任何其他你想不到的领域吗?我们完蛋了。
相似文章
怀念仅仅三年前的日子……
一篇个人随笔,回顾过去三年AI的飞速演进:从早期ChatGPT和GPT-4的配额,到BabyAGI、DALL·E、语音克隆的登场。
Gemini与AI幻觉
讨论Google Gemini模型中的AI幻觉问题,突出大型语言模型在可靠性和准确性方面的挑战。
@googleaidevs:我们见到了 Gemini TTS 的一些惊艳用例,以下是其中几个
Google AI 开发者展示了 Gemini TTS 在真实世界中的多项亮眼应用。
我们是否只在用户准备好时才测试AI
本文质疑当前的AI基准测试是否足以评估AI在实时、后台环境(如语音通话、自动驾驶和智能眼镜)中的表现,因为这些测试假设用户已做好准备。
Claude Opus 4.7、Qwen 3.6、Happy Oyster、实时3D世界、全新Google TTS:AI新闻
Anthropic、阿里巴巴、谷歌等巨头集中发布重磅模型——Claude Opus 4.7、Qwen 3.6、情感丰富的Google TTS,还有仅1.58-bit的手机LLM与实时3D世界生成器,同时开放视频、VR及角色创作工具。