第一次被模型吓到。

Reddit r/singularity 模型

摘要

作者描述被GPT 5.6和Codex深深打动且不安,强调该模型能够分解任务、回忆错误,并提出了一个优化后的流程及其具体效率提升。

整个晚上我都在摆弄GPT 5.6、Codex和搭建测试框架。我甚至不知道如何描述我刚才看到的一切。它分解任务的方式,能够回忆自己犯过的错误,能够精确描述一个改进后的流程会是什么样子,以及流程结束时的效率提升。这东西就像一把剃刀,我的脑子在飞速运转,想着我所经历的相对简单的过程能应用到多少场景中去。
查看原文

相似文章

想法?

Reddit r/AI_Agents

用户反思新推出的GPT 6模型,指出其成本较低但模型切换问题依旧存在,并分享了添加低成本AI集群后的良好体验。

利用 GPT-5.1-Codex-Max 构建更多

OpenAI Blog

OpenAI 推出 GPT-5.1-Codex-Max,这是一款新的智能代理编码模型,具有改进的推理能力、token 效率,以及通过“压缩”机制在数百万个 token 上保持连贯工作的能力。该模型更快速、更智能,可以持续运行数小时甚至数天的长时间任务,代表了 AI 辅助软件工程的重大进步。

推出 GPT-5.2

OpenAI Blog

OpenAI 推出 GPT-5.2,这是目前最强大的模型系列,在知识工作、代码生成、图像理解、长上下文理解和工具调用方面都有显著提升。GPT-5.2 Thinking 变体在专业基准测试中达到最先进的性能,在 44 个职业的 GDPval 任务中,70.9% 的表现超越了人类专家。