Z.ai的Ox Alpha揭示AI经济的哪些秘密(3分钟阅读)

TLDR AI 模型

摘要

Z.ai揭示了其背后是广受欢迎的Ox Alpha模型,并发布了GLM-5.3-Flash,这是一个为极致效率和低成本推理而设计的多模态模型,性能与领先模型相当,但成本仅为一小部分。

GLM-5.3-Flash是Z.ai在GLM-5系列中的首款原生多模态模型。该模型以Ox Alpha的名义匿名发布在OpenCode和OpenRouter平台上,在该平台上完全超越了排行榜并迅速走红。所有流量均由中国AI芯片提供支持。该模型在架构上追求极致效率,并专门为超低成本推理而设计。
查看原文
查看缓存全文

缓存时间: 2026/08/27 15:51

# Z.ai的Ox Alpha模型揭示了AI经济学的哪些真相 来源:https://www.thedeekview.com/articles/what-z-ai-s-ox-alpha-reveals-about-ai-economics 中国人工智能实验室Z.ai公开宣布,其匿名发布的Ox Alpha模型实为自家产品。 周三,Z.ai正式推出GLM-5.3-Flash(https://z.ai/blog/glm-5.3-flash),这是GLM-5系列中首个原生多模态模型。该公司表示,该模型此前以Ox Alpha之名在OpenCode和OpenRouter平台上匿名发布,并迅速登顶各项排行榜(https://www.thedeepview.com/articles/the-mystery-model-testing-ai-s-shrinking-moats),因其单日处理能力可达百万亿token而引发广泛关注。 值得关注的是,Z.ai在公告中特别指出,该模型爆红期间产生的所有流量均"由中国AI芯片承载"。 该模型总参数量达3200亿,其中活跃参数为180亿,在多项基准测试中性能超越上一代GLM-5.2,且成本仅为十分之一。 Z.ai实验室同时宣称,GLM-5.3-Flash在编程与智能体相关基准测试中已接近Claude Opus 4.8的表现,其软件工程、多步智能体任务、工具使用及专业工作等维度的性能与DeepSeek-V4、GPT-5.6 Terra及Gemini 3.7 Flash处于同等水平。 公司表示该模型采用"极致效率"架构设计,"专为超低成本推理场景打造": - GLM-5.3-Flash通过混合注意力架构实现"以少胜多",在保持精度的前提下显著降低长上下文查询的处理成本 - 模型通过"流形约束超连接"技术提升信息在神经网络层间的传递效率,从而优化"扩展效率" - 目前模型权重已在Hugging Face平台开放,同时为Z.ai旗下编程工具ZCode提供支持 Z.ai在公告中强调:"GLM-5.3-Flash证明了前沿智能无需前沿成本。我们正在将这一方案扩展至更大规模模型——该模型推动了成本效益前沿的发展,其构建过程中获得的经验已开始指导我们下一代前沿模型的开发。" 在开源模型的关键时刻,Z.ai的Ox Alpha亮相具有特殊意义:据TechCrunch报道,开源模型平台Hugging Face近期收到估值130亿美元的收购要约(https://techcrunch.com/2026/08/24/hugging-face-reportedly-in-talks-to-be-acquired-for-13b/);英伟达上周宣布投资60亿美元用于强化美国开源AI生态系统(https://finance.yahoo.com/technology/ai/articles/nvidias-6-billion-deal-poolsides-054000693.html)。 但中国企业或许正在瞄准企业的特定痛点:token使用成本(https://www.thedeekview.com/articles/chinese-ai-bets-price-can-overcome-trust)。LogicMonitor首席AI官Karthik Sj向The Deep View表示,性能媲美闭源供应商的中国AI模型,可能对那些在AI自由支出期后面临预算压力的开发者具有吸引力。 Sj指出:"Ox Alpha案例表明,零成本或低成本模型接入初看颇具吸引力,但免费通道往往伴随隐性成本。尽管Z.ai公开其作为幕后研发方的身份缓解了部分可审计性质疑,但经过严格验证的模型仍是更稳妥的选择。" ## 深度*观察* 虽然Z.ai发布GLM-5.3-Flash明显瞄准成本与资源效率,但该模型的流行还揭示了另一趋势:并非所有日常应用模型都需要处于技术巅峰。GLM-5.3-Flash虽与Anthropic、Google、OpenAI等实验室的前沿模型性能相当或略逊,但模型无需具备超凡能力也能创造巨大价值。尽管OpenAI正尝试以降价策略引导用户采用其前沿模型(https://www.thedeekview.com/articles/why-openai-is-resetting-frontier-ai-prices),但这类低成本推理服务难以长期持续。对于绝大多数企业任务而言,中等性能已能满足需求,特别是在追求投资回报率的场景下。

相似文章