@no_stp_on_snek: 很酷。GLM似乎就是,算了,我们挺好的。

X AI KOLs Following 新闻

摘要

一条推文展示了8个LLM在概率问题上的推理轨迹可视化,突出了自我修正和转向的时刻。

很酷。GLM似乎就是,算了,我们挺好的。
查看原文
查看缓存全文

缓存时间: 2026/07/06 16:08

非常酷。GLM 好像是在说,不,我们挺好的。

stevibe (@stevibe): 你知道每个大语言模型思考轨迹里那个“但是,等一下……”的时刻吗?

我让它变得可见了。

我给 8 个模型问了同一个棘手的概率问题,并把它们的推理过程呈现为树状结构。每当模型否定自己的思路并转向,每当出现“但是……”,每当出现“等等,实际上……”,一个新

相似文章

@lateinteraction: 非常酷的工作!!

X AI KOLs Timeline

Guowei Xu 讨论了 Best-of-N 和树搜索方法在 LLMs 处理困难推理问题时的局限性,指出验证信号稀疏且候选答案仍处于模型的分布范围内。