Kimi K3 能否解决与 Claude Fable 相同的问题?

Reddit r/LocalLLaMA 新闻

摘要

一场讨论,质疑像 Kimi K3 或 GLM 这样的开源模型能否复现 OpenAI 和 Anthropic 的闭源模型近期在数学和网络安全问题解决方面所取得的成就。

尽管本地模型在显著进步,但似乎没有人尝试复现闭源模型已有的成就。当它不可避免地发布时,是否有人愿意在自己的本地服务器集群上运行 GLM 或 Kimi(如果你有的话),确保它不能访问互联网,并看看它能否解决闭源模型近期解决的两个著名数学问题(我认为 GLM 在第一个问题之前就已发布,因此不在训练数据中;而 Kimi 在第二个问题之前就停止了训练):https://openai.com/de-DE/index/model-disproves-discrete-geometry-conjecture/ https://web.archive.org/web/20260721173628/https://www.newscientist.com/article/2580374-ais-solution-to-87-year-old-riddle-takes-mathematicians-by-surprise/ 或者,或许是一些由 mythos 解决的网络安全问题,确保使用过去的 GitHub 提交,移除最近的修复:https://www.anthropic.com/glasswing 那么,是否有合格的数学家或网络安全专家来验证模型输出的结果?我只是非常好奇,想知道闭源模型能够做到的改变世界的事情,是否真的触手可及——对我们开源社区来说。
查看原文

相似文章

Kimi K3 会改变关于蒸馏的争论吗?

Reddit r/singularity

Kimi K3 近期的排名挑战了那种认为中国 AI 模型严重依赖从美国模型蒸馏的观点,因为它在 Fable 5 和 GPT-5.6 发布后不久就发布了。文章认为,Kimi K3 体现了中国的大量创新。

Kimi K3 泄露:与 Fable 相当

Reddit r/LocalLLaMA

关于 Kimi K3 的泄露细节表明其性能与 Fable 相当,标志着 AI 模型领域的一个竞争性发展。

Kimi K3 就像展窗里的 F1 赛车。

Reddit r/LocalLLaMA

Moonshot 发布了 Kimi K3,这是一个极其庞大的 AI 模型,即便在配备多块 RTX 6000 Blackwell GPU 的本地工作站上也无法原生运行,促使作者尝试通过破解或蒸馏的方式让它跑起来。