@patio11:在最近的约两次大型实验室模型发布中,他们从“这将是来自中位数低资深同事的可接受输出”变为……
摘要
Patrick McKenzie 观察到,主要实验室近期发布的AI模型在输出质量上有了显著提升,从平均同事水平跃升至令人印象深刻的好水平。
在最近的约两次大型实验室模型发布中,他们从“这将是来自中位数低资深同事的可接受输出”变为“这好得令人害怕。”
我认为那些不天天使用模型的人不太可能理解这一点,所以,我在此说明。
查看缓存全文
缓存时间: 2026/09/29 11:53
过去大约两轮大厂模型迭代中,其表现已从“勉强达到普通初级同事的平庸输出“跃升至“惊艳到令人不安的程度“。我认为非深度用户未必能深刻领会这种跨越,因此特此说明。
相似文章
视频模型日益强大
本文讨论了AI视频模型日益增强的能力和改进,强调了它们在生成或处理视频内容方面的效果日益显著。
我几个月前就不再比较模型了。我的输出质量反而提升了。
作者分享说,他不再比较AI模型,转而专注于工作流设计,结果输出质量反而提升了。他认为对于大多数实际用例,工作流比模型选择更具杠杆效应。
@rohanpaul_ai: Arcads' Actors+ 是 AI 视频质量为何正成为一个感知问题的绝佳例证。你可以一直改进 …
Arcads' Actors+ 是一个 AI 演员库,它使 AI 生成的视频几乎与真实用户内容难以区分,突显了提升 AI 视频质量时面临的感知挑战。
AI模型变得更为可靠,但AI实验室却忘了让它们更智能(SciCode)
文章认为,AI模型已变得更可靠,但智能提升已趋于平缓,暗示经过适当增强的旧模型如GPT-4 turbo可能与新款模型媲美。
@mattpocockuk: Uncle Bob 明白了
Robert C. Martin (Uncle Bob) 分享了他的经验:使用AI代理能显著提高生产力,虽然30-40%的时间用于调优和加固输出。