Writer推出新AI模型及升级版工具链以控制Token成本

TechCrunch AI 模型

摘要

Writer发布了基于Z.ai开源模型GLM-5.2构建的新旗舰AI模型Palmyra X6,同时推出升级版智能体工具链,旨在为企业客户削减高达50%的Token成本。

作为Z.ai开源模型GLM-5.2的后训练变体,Writer表示新系统应以更低价格提供可随时部署的能力。
查看原文
查看缓存全文

缓存时间: 2026/08/13 21:23

# Writer推出新AI模型及升级版框架以控制Token成本 | TechCrunch Source: https://techcrunch.com/2026/08/13/writer-introduces-new-ai-model-and-upgraded-harness-to-contain-token-costs/ 在整个AI行业,用户越来越意识到其部署可能带来的高昂成本,并感受到削减开支的新紧迫感。尽管开源模型提供了显著更低的每token成本,但要为特定任务找到合适的模型仍然很困难。 周四,为营销人员提供AI工具和智能体的Writer发布了一款名为Palmyra X6的新旗舰模型,旨在为用户解决这一问题。Writer表示,该新系统是在Z.ai的开源模型GLM-5.2基础上进行后训练变体开发,应以更低价格提供可直接部署的能力。公司估计,新模型加上公司框架基础设施的改进,将为客户在基础任务上削减高达50%的成本。 除了新模型外,该公司还对其标准智能体框架进行了重大升级。这两项功能将从周四起向Writer客户提供。 “我认为企业已经彻底厌倦了追逐下一个基准,”CEO May Habib告诉TechCrunch。“他们希望成本趋于平稳,但似乎没人能做到这一点。” 新方法特别强调复杂、多步骤任务,并以更少的token更快执行。Writer将框架优化视为实现这一目标的关键杠杆。 Writer研究人员最近发表的一篇论文(https://arxiv.org/pdf/2607.06906)为这种方法提供了佐证,该论文在多种不同模型上测试了框架效率的微小变化。研究发现,在许多情况下,改变框架比选择模型更能可靠地降低成本,在他们的测试中成本平均下降了40%。 “框架是这样一个组件,其效率会在组织运行的每个模型(现在和未来)上成倍放大,”研究人员写道。 对于Writer的客户来说,体验仍然与模型无关:Palmyra X6将与Writer的其他模型或通过Azure或Amazon Bedrock导入的外部模型并列。但Habib也认为,削减成本的推动力正在引发对主要AI实验室的更广泛不信任,这些实验室有增加token使用的财务动机。 “对客户来说,这里的成本爆炸是前所未有的,首席信息官们对实验室的放弃程度也是如此,”Habib告诉TechCrunch,并补充说,AI实验室“并不深刻理解如何帮助企业从AI中获益。” *如果您通过我们文章中的链接购买商品,我们可能会赚取少量佣金 (https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。* Russell Brandom自2012年以来一直报道科技行业,重点关注平台政策和新兴技术。他曾就职于The Verge和Rest of World,并为Wired、The Awl和MIT Technology Review撰稿。可通过[email protected]或Signal(412-401-5489)与他联系。 查看简介 (https://techcrunch.com/author/russell-brandom/)

相似文章

@AlphaSignalAI: https://x.com/AlphaSignalAI/status/2074130508833845396

X AI KOLs Timeline

自我改进的机制使AI代理能够通过分析执行轨迹自主重写其运行规则,从而实现60%的性能提升。来自上海AI实验室的研究引入了Self-Harness框架,使得轻量级模型能够在无需人工工程的情况下超越更大规模的模型。