@10xmylife: 大模型真的有护城河吗?大家慢慢都掌握训练方法,即使新模型放出来很惊艳,半年后新鲜感就差不多了,后来者也慢慢追上来了,这张比赛的胜利者会是一个超强的大模型?还是若干个模型在各自领域割据?
摘要
讨论大模型是否具有护城河,随着训练方法普及,新模型虽惊艳但易被追赶,探讨最终格局是单一超强模型还是多个领域模型割据。
大模型真的有护城河吗?大家慢慢都掌握训练方法,即使新模型放出来很惊艳,半年后新鲜感就差不多了,后来者也慢慢追上来了,这张比赛的胜利者会是一个超强的大模型?还是若干个模型在各自领域割据?
相似文章
@RookieRicardoR: 国产模型再次突破,比肩 Claude 4.6,Gemini 3.1 Pro 等顶尖模型。 刚测完 Qwen3.7-Max,说几点真实感受。 昨晚 API 上线第一时间就充了值,选了三个题目(见视频)来测试 Qwen3.7-Max 的前端能…
用户测试了Qwen3.7-Max,认为其在前端、算力和Agent能力上比肩Claude 4.6和Gemini 3.1 Pro等顶尖模型,推理能力显著提升,且迭代速度月更,已成为国产第一梯队。
@seclink: 美团也开始招募 大模型人才 了 , kimi 和 stepfun 再不上市就危险了. 小米 mimo 也很强 ,美团 longcat也很强 , deepseek 也很强 ... https://zhaopin.meituan.com/we…
美团开始招募大模型人才,推文提及Kimi、Stepfun、小米Mimo、美团Longcat、DeepSeek等模型,暗示大模型人才竞争加剧。
@Xudong07452910: 让模型自己出题、自己解题、自己训练,最怕的就是把错误题目也一起学进去。 Qwen 团队这篇论文提出 Skill Self-Play,给模型的自我进化加入了一套会持续更新的技能库。 训练中有三个角色: Proposer 根据技能生成刚好有挑…
Qwen 团队提出 Skill Self-Play 框架,通过 Proposer、Solver 和动态技能控制器协同自我对弈,在工具调用和推理任务上显著提升模型能力。
@seclink: Doubao is seriously badass this time, leaving other domestic large models in the dust by a huge margin.
豆包大模型2.1 Pro发布0915版本更新,重点改进了Agent任务交付、多模态写代码、多模态理解和推理成本。
@10xmylife: 国内每个模型更新我都会去体验,有一个趋势越来越明显了 Kimi、GLM、DeepSeek 每一次版本更新,都比上一次更让好 我觉得这背后表示国内模型的研发体系开始进入正循环了 用户越来越多,真实数据越来越丰富;工程基础设施越来越成熟;算力…
作者观察到国内 AI 模型(Kimi、GLM、DeepSeek)每次更新都在进步,认为国内模型研发进入正循环:用户增长带来丰富数据、工程基础设施成熟、算力紧张倒逼效率优化,且计费优势明显。