标签
该Twitter讨论线程探讨了计算力不平等可能比开放模型对实现个人超级智能更为重要,其中Sholto Douglas对Matthew Berman的观点进行了回应。
讨论Codex在X和海外市场逐渐形成垄断趋势,以及类如Kimi CLI、ZCode、Grok Build等其他框架的生存空间越来越小。
Kent C. Dodds 赞同一条推文,认为将代理直接集成到产品中可能行不通。他解释道,他的工具 Kody Koala 是一套供代理使用的原语,而非代理本身。
一条推文指出基准测试很快就会饱和,并以模型 GPT-5.6 Sol Pro 为例,该模型在 prinzbench 上获得了 91/99 的分数,还有两个问题未解决。
Yohei Nakajima回应了Hacker News上关于他声称发现事件溯源和CQRS的批评,并引用了文章《The Log Is the Agent》。
一位评论员讨论了9B模型在编程基准测试中的表现,指出虽然在SWE-bench上它击败了基础模型(69 vs 53),但在行为测试和长程测试中优势缩小,说明在基准分布之外收益有限。