我几个月前就不再比较模型了。我的输出质量反而提升了。

Reddit r/AI_Agents 新闻

摘要

作者分享说,他不再比较AI模型,转而专注于工作流设计,结果输出质量反而提升了。他认为对于大多数实际用例,工作流比模型选择更具杠杆效应。

我曾把模型选择当成技术栈里最重要的决定。GPT vs Claude。Claude vs Gemini。基准测试、上下文窗口、推理分数——就是对着图表和分数瞎折腾,试图为我的技术栈找到性价比最高的模型。后来我忙起来了,随便挑了一个就一直用下去。六个月后,我真的看不出结果有什么差别。真正改变我输出质量的,是我围绕模型构建工作流的方式,而不是我选了哪个模型。另外我觉得自己以前把“我得比较新模型”当成了不干活的借口,所以现在我能完成更多工作了。我坚信,对于大多数实际用例,工作流设计比模型选择更具杠杆效应。有人跟我有同感吗?还是你们仍然认为模型选择是一个重要变量?另外,没有完美的技术栈或AI模型,你总得在某些方面妥协。
查看原文

相似文章

我不再追逐新模型。那时AI才真正变得有用。

Reddit r/AI_Agents

反思如何将注意力从追逐新AI模型转向理解自己的手动工作流程,从而使AI真正发挥作用。作者建议将成功的对话转化为可复用的技能,并警告避免因炒作而参与昂贵的工具试用。

我们是否高估了模型智能,低估了工作流质量?

Reddit r/AI_Agents

文章认为,令人印象深刻的AI与无用的AI之间的区别往往不在于模型本身,而在于围绕它的工作流——上下文、记忆、工具访问和编排。它表明,工作流架构可能成为比原始模型能力更重要的竞争优势。