AI经常连非常基础的事实都弄错。模型关注的是平均值——而不是精确答案
摘要
用户报告称,AI模型Gemini和Claude在旅行中提供了错误的公交时刻表信息,这些模型承认它们给出的是近似答案而非精确事实,这凸显了可靠性问题。
我们一家正在欧洲旅行,向Gemini和Claude询问了关于公交时刻表的简单问题——它们都完全错了。顺便说一下,我们为这两者都付费订阅了。当我们追问为什么它们连简单的时刻表都读不懂时,它们都承认自己走捷径,'插值'出近似答案。这带着孩子和拖着沉重的行李旅行时毫无帮助——AI给出的时间竟然差了一个多小时。如果连简单的请求都无法满足……
相似文章
Gemini 为何还会犯这种错误?
这篇文章质疑为什么谷歌的 Gemini AI 模型仍然会出现明显的错误,探讨了其训练或部署中可能存在的问题。
AI自信地给你过时的信息。原因之一及如何避免
解释为何AI模型因上下文持续存在而自信地提供过时信息,并提供实用建议,如使用干净的上下文和时间戳值。
ChatGPT、Gemini、Claude、Grok 未能通过选举话题准确性测试:Forum AI
Forum AI 的一项研究发现,ChatGPT、Gemini、Claude 和 Grok 等主要聊天机器人未能提供准确且无偏见的选举信息,其中 90% 的回答包含错误或偏见。
我给谷歌AI做了一个简单测试,它连续三次在不同浏览器中给出了错误答案,尽管它说会记录正确答案并记住以供将来使用。
一位用户报告称,谷歌AI反复给出错误答案(关于“有史以来最薄的笔记本电脑”),即使在承认错误后也未能从中学习。
为什么在知识库看似正确的情况下,AI 仍然会出错?
本文探讨了为什么即使底层知识库看起来准确,AI系统仍然会产生错误的输出。