@10xmylife: 国内每个模型更新我都会去体验,有一个趋势越来越明显了 Kimi、GLM、DeepSeek 每一次版本更新,都比上一次更让好 我觉得这背后表示国内模型的研发体系开始进入正循环了 用户越来越多,真实数据越来越丰富;工程基础设施越来越成熟;算力…
摘要
作者观察到国内 AI 模型(Kimi、GLM、DeepSeek)每次更新都在进步,认为国内模型研发进入正循环:用户增长带来丰富数据、工程基础设施成熟、算力紧张倒逼效率优化,且计费优势明显。
查看缓存全文
缓存时间: 2026/07/21 18:49
国内每个模型更新我都会去体验,有一个趋势越来越明显了 Kimi、GLM、DeepSeek 每一次版本更新,都比上一次更让好
我觉得这背后表示国内模型的研发体系开始进入正循环了
用户越来越多,真实数据越来越丰富;工程基础设施越来越成熟;算力虽然依然紧张,却反而逼着团队不断优化训练、推理和算法效率,而不是简单堆 GPU。
而且国内模型的计费优势也很明显,一个算美刀,一个算人民币,没办法比啊。
虽然还不适合完全做生产级别的模型,但是用来执行规划绰绰有余了。
差距越来越小了。
相似文章
@Sxy_Cherotich: 最近找了蛮多 model researchers 交流,一个共识结论是:数据的重要性再次凸显。 前阵子认识了 ex-kimi,在做数据方向创业的@FanqingMengAI,请他来录了一期播客。 聊出的一个最大非共识,是繁青对国内外模型差…
一篇关于AI模型竞争的播客内容,讨论数据重要性、蒸馏与预训练创新,以及与Evolvent AI联创孟繁青的访谈,涉及合成数据、RSI和国内模型差异等话题。
@YRSM_Simon: 期待 Local AI 能尽快达到第一梯队的水平
Kimi K3 成为首个在 DeepSWE 基准上达到前沿性能的开放权重模型,排名第三,效果与 Claude Fable 和 GPT-5.6 Sol 相当。
Open source battle: GLM vs Kimi vs MiMo vs DeepSeek
本文测试了智谱GLM 5.1、月之暗面Kimi K2.6、阶跃星辰MIMO 2.5 Pro和深度求索DeepSeek V4 Pro四个开源中国AI模型在编程任务中的表现,发现GLM在多数任务中整体领先但非绝对,各模型各有优劣。
不到一个月:Kimi K3、Qwen3.8、DeepSeek-V4-Pro-0813、GLM-5.3
过去一个月内,多家中国领先的AI实验室发布了新的旗舰模型,包括Kimi K3、Qwen3.8、DeepSeek-V4-Pro和GLM-5.3,标志着中国AI竞赛的快速进展。
@0xcherry: https://x.com/0xcherry/status/2067610347633025281
本文分析智谱GLM-5.2性能飞跃的原因,认为其40B激活参数在扣除固定开销后提供更大有效容量,使RL后训练更有效;同时回顾中国AI模型发展史,指出大模型路线最终获胜。