twitter-discussion

标签

Cards List
#twitter-discussion

@MatthewBerman: "计算力不平等将在拥有个人超级智能方面远比开放模型更重要" 这是我最大的 ...

X AI KOLs Following · 2天前 缓存

该Twitter讨论线程探讨了计算力不平等可能比开放模型对实现个人超级智能更为重要,其中Sholto Douglas对Matthew Berman的观点进行了回应。

0 人收藏 0 人点赞
#twitter-discussion

@vista8: 感觉 Codex 渐渐有垄断趋势了,至少在 X 和海外。 虽然模型与自己Harness 框架下执行会更好。 比如kimi cli搭配K3、zcode搭配 glm5.2、grok build 搭配 grok4.5 等,Deepseek 马上…

X AI KOLs Timeline · 2026-08-05 缓存

讨论Codex在X和海外市场逐渐形成垄断趋势,以及类如Kimi CLI、ZCode、Grok Build等其他框架的生存空间越来越小。

0 人收藏 0 人点赞
#twitter-discussion

@kentcdodds: 这就是我过去一年一直在说的。这也是为什么 @kodykoala 不是一个代理,而是一套非常强大的原语…

X AI KOLs Timeline · 2026-07-22 缓存

Kent C. Dodds 赞同一条推文,认为将代理直接集成到产品中可能行不通。他解释道,他的工具 Kody Koala 是一套供代理使用的原语,而非代理本身。

0 人收藏 0 人点赞
#twitter-discussion

@gdb:如今基准测试很快就会饱和

X AI KOLs Following · 2026-07-16 缓存

一条推文指出基准测试很快就会饱和,并以模型 GPT-5.6 Sol Pro 为例,该模型在 prinzbench 上获得了 91/99 的分数,还有两个问题未解决。

0 人收藏 0 人点赞
#twitter-discussion

@yoheinakajima: 有些人在Hacker News上对我表现得像是我发现了事件溯源和CQRS感到不满

X AI KOLs Timeline · 2026-07-06 缓存

Yohei Nakajima回应了Hacker News上关于他声称发现事件溯源和CQRS的批评,并引用了文章《The Log Is the Agent》。

0 人收藏 0 人点赞
#twitter-discussion

@no_stp_on_snek: 有人会晃着成绩卡对我说:9B模型在编程基准测试中碾压了它的基础模型(SWE-bench 69 vs 53)。确实如此。但关于……

X AI KOLs Following · 2026-06-28 缓存

一位评论员讨论了9B模型在编程基准测试中的表现,指出虽然在SWE-bench上它击败了基础模型(69 vs 53),但在行为测试和长程测试中优势缩小,说明在基准分布之外收益有限。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈