@FeitengLi: LLM 玩的好多技术 Povey 在 Zipformer 里都探索过

X AI KOLs Timeline 模型

摘要

Z.ai 推出 GLM-5.3-Flash,这是一个具有 1M 代币上下文窗口的多模态 AI 模型,参数规模为 320B-A18B,并以 MIT 许可证发布。

LLM 玩的好多技术 Povey 在 Zipformer 里都探索过😑
查看原文
查看缓存全文

缓存时间: 2026/08/29 10:02

Povey在Zipformer中确实探索过很多相关的技术思路,这让我感到有些惊讶。

Z.ai (@Zai_org):
介绍 GLM-5.3-Flash

  • 在极具竞争力的价格下提供领先能力
  • 原生多模态,支持100万token上下文窗口
  • 320B-A18B模型,基于MIT协议开源
  • 此前以Ox Alpha为名进行预览,完全运行在中国AI芯片上

博客链接:

相似文章

GLM-5.2 可能是目前最强大的纯文本开放权重大语言模型

Simon Willison's Blog

中国AI实验室Z.ai发布了GLM-5.2,这是一个拥有7530亿参数的开放权重大语言模型,支持100万token的上下文窗口,采用MIT许可证。该模型在Artificial Analysis Intelligence Index上获得最高分,并在Code Arena WebDev排行榜上排名第二。

@Khazix0918: https://x.com/Khazix0918/status/2065790596653183156

X AI KOLs Timeline

智谱发布了GLM 5.2模型,专注于Coding能力,开源且支持1M上下文。实测显示其在大型工程和代码任务上接近Claude Opus 4.8水平,但缺乏多模态能力,受限于算力导致速度较慢。文章也提及Anthropic因美国商务部要求关停Fable 5和Mythos 5的事件,突显了AI开源与封闭的对比。

@0xcherry: https://x.com/0xcherry/status/2067610347633025281

X AI KOLs Timeline

本文分析智谱GLM-5.2性能飞跃的原因,认为其40B激活参数在扣除固定开销后提供更大有效容量,使RL后训练更有效;同时回顾中国AI模型发展史,指出大模型路线最终获胜。

Z.ai 完全在中国AI芯片上运行GLM-5.3-Flash

Reddit r/singularity

Z.ai宣布,其完全在中国AI芯片上运行了GLM-5.3-Flash模型,每个token的成本与Nvidia GPU相当,并使用了一个针对内存受限硬件优化的自定义推理引擎。