@GergelyOrosz:每次有新模型,我都会用它来做写作测试——看看它是否能像我一样工作——我给它一堆我做的采访……

X AI KOLs Timeline 新闻

摘要

Gergely Orosz 测试新AI模型(如Fable和GPT-6),要求它们根据他的采访写出他风格的文章,但发现它们彻底失败,写了很多字却没有理解。

每次有新模型,我都会用它来做写作测试——看看它是否能像我一样工作——我给它一堆我针对某个主题做的采访,然后让它用我的风格写一篇文章。 这些模型彻底失败,Fable 和 GPT-6 也不例外。写了很多字,但没有理解。
查看原文
查看缓存全文

缓存时间: 2026/07/13 22:00

每一次新模型发布,我都会在写作任务上对其进行测试——看看它能否胜任我的工作。我会提供一批针对某个话题的采访素材,要求它按我的风格写成文章。

这些模型全都惨败,Fable 和 GPT-6 也不例外。一堆废话,毫无理解力。

相似文章

A new era of AI testing (2 minute read)

TLDR AI

A compilation of Andrej Karpathy's recent tweets covering a minimal GPT implementation, vibe coding an iOS app, and a detailed comparison of GPT-4.5 with earlier models, offering insights into AI testing and scaling.