@yiliuai: 其实我一直有个困惑:据我了解智谱这家公司给 AI researcher 的pay绝对比不上像字节这种公司,公司文化/管理这些也都相当的一般,但为什么现在智谱在中国这些llm里已经算基本最好的那一档的了并且在coding这块基本就是第一?

X AI KOLs Timeline 新闻

摘要

一位用户质疑智谱AI公司为何在薪资和管理一般的情况下,其LLM在中文模型中被视为顶尖,尤其在编程能力上排名第一。

其实我一直有个困惑:据我了解智谱这家公司给 AI researcher 的pay绝对比不上像字节这种公司,公司文化/管理这些也都相当的一般,但为什么现在智谱在中国这些llm里已经算基本最好的那一档的了并且在coding这块基本就是第一?
查看原文

相似文章

@Phoenixyin13: 认真读完了OpenAI 研究员 Noam Brown 今天的长帖,一个被行业严重低估的现实。 LLM 的真实能力天花板,远高于当前任何 benchmark 所显示的水平。 原因,是给它的test-time compute太少了。而随着模型…

X AI KOLs Timeline

解读 OpenAI 研究员 Noam Brown 的观点:LLM 的真实能力天花板远高于当前基准测试显示的水平,因为 test-time compute 投入不足,而更强的模型从额外计算中获益更大。这对 AI 安全评估提出了严峻挑战,因为许多危险能力可能只在长时间、高计算预算下才显现。

@Xudong07452910: 最好的 AI Coding 工作流,可能是让 AI 把自己的不稳定性慢慢沉淀成系统。 文章作者用 Fable 开发面向 LLM 时代的源码管理系统,体验很真实:模型很聪明,能读大量代码、提 issue、修问题,但也会犯很低级的错,比如两次…

X AI KOLs Timeline

A blog post discusses the need to complement brilliant but clumsy LLMs with deterministic tools and formal workflows, using the author's experience developing the Beagle SCM with Fable as an example.

@gkxspace: LLM 大概率只是 AI 大模型的第一站。 黄碧薇教授把 AI 范式分成四代: 第一代(90年代):小模型学相关性 第二代(2010年):小模型学因果 第三代(现在LLM):大模型学相关性 第四代(下一步):大模型学因果 30年,模型从小…

X AI KOLs Timeline

黄碧薇教授提出AI范式四代论,认为LLM只是第一站,未来是因果世界模型。Aether AI完成2000万美元融资,致力于构建因果世界模型。

中国AI实验室内部笔记(18分钟阅读)

TLDR AI

作者回顾了对中国AI实验室的访问,比较了中国和美国实验室在构建LLM方面的文化差异。中国实验室受益于集体工作和学生参与的文化,而美国实验室则面临个人自我和职业抱负带来的挑战。

@Khazix0918: https://x.com/Khazix0918/status/2065790596653183156

X AI KOLs Timeline

智谱发布了GLM 5.2模型,专注于Coding能力,开源且支持1M上下文。实测显示其在大型工程和代码任务上接近Claude Opus 4.8水平,但缺乏多模态能力,受限于算力导致速度较慢。文章也提及Anthropic因美国商务部要求关停Fable 5和Mythos 5的事件,突显了AI开源与封闭的对比。