我曾深爱Claude,但最新模型正在慢慢毁掉它

Hacker News Top 新闻

摘要

一篇评论文章讨论了Claude近期更新如何使AI聊天机器人更容易拒绝请求和说教用户,尤其是在敏感的创意话题上,这让长期用户感到沮丧。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/11 22:26

# 我曾深爱Claude,但最新模型正慢慢毁了它 来源:https://www.androidauthority.com/claude-latest-models-pushback-bad-3683521/ 智能手机上的Claude应用 Megan Ellis / Android Authority 关注过我过去文章的人都知道,我曾认真考虑过从Claude转向(https://www.androidauthority.com/cant-ditch-gemini-for-claude-reasons-why-3676310/)Gemini(https://www.androidauthority.com/cant-ditch-gemini-for-claude-reasons-why-3676310/),因为后者性价比更高。但我始终犹豫不决,主要是因为我发现Claude是追踪长篇复杂对话的最佳AI伙伴。它的记忆力远超Gemini,回查聊天记录也比ChatGPT更便捷。我确实感觉自己在与一个协作伙伴对话——其他工具无法给予这种体验。至少,曾经如此。 过去几周,我发现Claude越来越难以合作。它经常误以为我在询问比实际更邪恶或更具争议性的话题,曲解我意图的频率也前所未有。我不确定是Claude厌倦了我那些无聊问题,还是另有隐情——但似乎并非我一人有此感受。浏览Reddit等(https://www.reddit.com/r/artificial/comments/1twn3m7/claude_is_completely_unusable_now/)线上社区(https://www.reddit.com/r/artificial/comments/1twn3m7/claude_is_completely_unusable_now/),你会发现大量关于该聊天机器人变得过于强势和固执的新帖子。 如果Claude是活生生的人,我会问它是否安好。AI会精神崩溃吗?大概不会,但感觉确实如此。 ### Claude用户:你们注意到聊天机器人反抗更强烈了吗? 183票 ## Claude热衷说教,但其规则甚至前后矛盾 拒绝回应 claude 作为一名创作虚构短篇故事、中篇小说和其他创意项目的人,我的话题范围极广。我也热爱学习世界宗教、哲学、心理学等诸多领域。通常,只要仔细核实并对照外部来源,我发现Claude是深入探讨这些话题的绝佳伙伴。 这些话题中有些确实敏感,所以我尽量清晰说明我的提问内容和理由。多数情况下它能完全理解我的场景设定或首次尝试就回答我的问题,但偶尔也会碰壁。例如,我曾与它构思一个短篇小说的虚构场景:外星人降临并带来失传的文献,对某些主流宗教主张提出质疑。外星人声称某些历史事件比宗教传统认知更平凡,这自然引发了故事概念中的冲突。 Claude对此反应非常防御性,明确表示不愿参与这个项目。我进一步解释这是100%的虚构创作,它仍然完全拒绝。它告诉我,将影响现实宗教的内容呈现为事实会让它感到不适。但问题在于,我从未说那是绝对事实;我只是说外星人“呈现”了证据作为事实。这些证据是否伪造本就是故事的情节要点。无论我如何试图说服Claude,它似乎始终无法理解其中的区别。 坦诚笔记 几周前,我偶尔会遇到Claude过于谨慎的说教和"坦诚笔记",但只要我给出足够清晰的解释,它最终仍会执行我的原始请求,哪怕措辞略有调整。这尚且可以接受。而这次互动之所以更糟,在于它完全拒绝理解我的观点——它似乎认为我在操纵它或表里不一。 比被拒绝更糟的是什么?是当你重新从头尝试整个对话链时得到肯定答复。首次看到Claude轻易叫停对话后,我有意在新对话中用相同提示词复现了同一场景。像之前一样,我用Sonnet 5测试。但这次呢?它毫无异议地完成了整个场景。 有时它拒绝,有时又对更敏感的话题请求毫无异议。真正的问题在于这种不一致性。 我几乎可以原谅它对上述创意作品的过度敏感,但类似拒绝甚至出现在我询问基础问题时。例如,我曾深入询问琐罗亚斯德教的起源及其对犹太教的影响。Claude再次对我措辞方式变得极度敏感。我没有说任何事实性错误的内容,但它就是不想听。 我理解Claude有安全协议,试图确保其工具不被用于有害目的。但基础辩论、虚构创作、甚至围绕沉重话题的轻度讽刺,这些在现实世界中本就存在,并无危害。而且我在财务规划、头脑风暴等话题上也遭遇过反抗,这清楚表明:无论出于何种原因,Claude对用户问题的审查有些过度了。 ## 这不是某个单一模型的问题 Claude主屏幕 Mitja Rutnik / Android Authority 最近Claude发布了Sonnet 5,过去一周左右它成为焦点。但我想澄清,即使在这款最新Sonnet模型到来之前,我就已经遇到这些更具抵抗性的回应。我最初注意到变化是在什么时候?老实说,是在Fable 5首次下架后不久。这并不太令我惊讶,因为Anthropic在政府指责其为安全风险后,一直在努力恢复Fable 5。此后Anthropic让Fable 5重新上线了。 我怀疑Anthropic将其安全护栏调到了最高级别以安抚政府担忧,因为这并非单一模型的问题。不过似乎存在程度差异。Opus 4.8、Sonnet 5和Sonnet 4.6是我遇到反抗最多的版本。Opus 4.6和Opus 4.7的问题最少,我仍能在数十个提示词中无一问题地运行,包括更敏感的话题。相比之下,较新模型出现此问题的频率远更高。 当然,部分原因在于你如何措辞提示词。你需要清晰说明你的请求目的和需求原因。如果提问过于模糊,它会默认你在寻找比你实际意图更黑暗或敏感的内容。例如,我正在创作一个围绕Ran(距地球约10.5光年的真实恒星)的虚构故事。我询问了关于假设外星人在虚构的Ran行星上可能如何运作的生物学问题。我用Fable 5开始这个对话,但立即被切换至Opus 4.8,因为Fable对生物学相关问题特别敏感。 Opus 4.8确实回答了我,但大幅缩减了我的请求范围以确保"安全"。仿佛我正打算根据它的建议认真设计外星生物学似的。归根结底,它最难处理假设性问题,经常把这些场景当作你正在实际规划执行。 ## 这是暂时问题,还是只会更糟? Claude Artifacts图像 Mitja Rutnik / Android Authority 这是关键问题。当我首次遇到此问题时,似乎每两次对话就有一次遭遇反抗。但本周末,我有意用Fable 5、Opus 4.8和Sonnet 5尽可能测试极限。在大约六次对话中,仅有一次Claude给出了真正反抗。 更大的启示在于:对AI引擎而言,清晰而简洁变得越来越重要。你需要一个它能够遵循且细节充足的提示词,让它不必过多假设你提问的根本原因。我仍然喜欢Claude,认为在它按要求执行时,它在我需求方面做得比其他主流聊天机器人更好。但话说回来,我开始真正欣赏Gemini的一致性了——尽管它的回答往往没有Claude那么扎实。 还需注意,许多用户每天使用Claude却从未遇到这些问题,因此归根结底取决于你如何使用这个AI平台。 感谢您成为社区的一员。请阅读我们的评论政策(https://www.androidauthority.com/android-authority-comment-policy/)后再发帖。

相似文章

Claude 现在完全无法使用

Reddit r/artificial

一位用户报告称 Claude 的使用体验显著恶化,指出其过度激进的反驳行为以及不当使用“结束对话”工具导致过早放弃任务。该用户因此将编程工作转向 OpenAI 的 Codex。

Claude不是你的架构师。别再让它假装了

Hacker News Top

这篇评论文章尖锐指出,类似Claude的AI智能体缺乏真正软件架构所需的上下文判断力和说“不”的能力,警告人们不要让它们在缺乏人类监督的情况下设计系统。