Writer推出新AI模型及升级版工具链以控制Token成本
摘要
Writer发布了基于Z.ai开源模型GLM-5.2构建的新旗舰AI模型Palmyra X6,同时推出升级版智能体工具链,旨在为企业客户削减高达50%的Token成本。
作为Z.ai开源模型GLM-5.2的后训练变体,Writer表示新系统应以更低价格提供可随时部署的能力。
查看缓存全文
缓存时间: 2026/08/13 21:23
# Writer推出新AI模型及升级版框架以控制Token成本 | TechCrunch
Source: https://techcrunch.com/2026/08/13/writer-introduces-new-ai-model-and-upgraded-harness-to-contain-token-costs/
在整个AI行业,用户越来越意识到其部署可能带来的高昂成本,并感受到削减开支的新紧迫感。尽管开源模型提供了显著更低的每token成本,但要为特定任务找到合适的模型仍然很困难。
周四,为营销人员提供AI工具和智能体的Writer发布了一款名为Palmyra X6的新旗舰模型,旨在为用户解决这一问题。Writer表示,该新系统是在Z.ai的开源模型GLM-5.2基础上进行后训练变体开发,应以更低价格提供可直接部署的能力。公司估计,新模型加上公司框架基础设施的改进,将为客户在基础任务上削减高达50%的成本。
除了新模型外,该公司还对其标准智能体框架进行了重大升级。这两项功能将从周四起向Writer客户提供。
“我认为企业已经彻底厌倦了追逐下一个基准,”CEO May Habib告诉TechCrunch。“他们希望成本趋于平稳,但似乎没人能做到这一点。”
新方法特别强调复杂、多步骤任务,并以更少的token更快执行。Writer将框架优化视为实现这一目标的关键杠杆。
Writer研究人员最近发表的一篇论文(https://arxiv.org/pdf/2607.06906)为这种方法提供了佐证,该论文在多种不同模型上测试了框架效率的微小变化。研究发现,在许多情况下,改变框架比选择模型更能可靠地降低成本,在他们的测试中成本平均下降了40%。
“框架是这样一个组件,其效率会在组织运行的每个模型(现在和未来)上成倍放大,”研究人员写道。
对于Writer的客户来说,体验仍然与模型无关:Palmyra X6将与Writer的其他模型或通过Azure或Amazon Bedrock导入的外部模型并列。但Habib也认为,削减成本的推动力正在引发对主要AI实验室的更广泛不信任,这些实验室有增加token使用的财务动机。
“对客户来说,这里的成本爆炸是前所未有的,首席信息官们对实验室的放弃程度也是如此,”Habib告诉TechCrunch,并补充说,AI实验室“并不深刻理解如何帮助企业从AI中获益。”
*如果您通过我们文章中的链接购买商品,我们可能会赚取少量佣金 (https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。*
Russell Brandom自2012年以来一直报道科技行业,重点关注平台政策和新兴技术。他曾就职于The Verge和Rest of World,并为Wired、The Awl和MIT Technology Review撰稿。可通过[email protected]或Signal(412-401-5489)与他联系。
查看简介 (https://techcrunch.com/author/russell-brandom/)
相似文章
@AlphaSignalAI: https://x.com/AlphaSignalAI/status/2074130508833845396
自我改进的机制使AI代理能够通过分析执行轨迹自主重写其运行规则,从而实现60%的性能提升。来自上海AI实验室的研究引入了Self-Harness框架,使得轻量级模型能够在无需人工工程的情况下超越更大规模的模型。
@rohanpaul_ai: 另一个例子表明,框架本身,而非模型,决定了智能能达到的程度。通过API……
这条推文突出了Atomic Agent(一个模型无关的代理层)如何通过执行模型操作和保持状态来提高GLM 5.3的性能,几乎将令牌使用量翻倍,而成本仅增加77美分。
Z.ai的Ox Alpha揭示AI经济的哪些秘密(3分钟阅读)
Z.ai揭示了其背后是广受欢迎的Ox Alpha模型,并发布了GLM-5.3-Flash,这是一个为极致效率和低成本推理而设计的多模态模型,性能与领先模型相当,但成本仅为一小部分。
@alighodsi: 在拥有1.1万名员工的情况下,我们的AI成本正在上升。我们应该使用哪种模型和框架来降低成本,同时保持卓越的质量……
Databricks发布了一项内部基准测试,在数百万行代码的代码库上评估编码代理,结果显示框架选择可加倍节省成本,并且像GLM 5.2这样的开源模型在最高难度级别上表现具有竞争力。
@baseten: 今天我们发布GLM-5.3 Fast:迄今为止最智能的开放权重模型之一,TPS更高。
Z.AI 发布 GLM-5.3 Fast,这是一款先进的开放权重AI模型,针对代理编码和网络安全进行优化,采用744B-A40B MoE架构,基准测试有显著改进。