深入探讨 ZCode(阅读时间 17 分钟)
摘要
本文深入评测了 ZCode,这是一款由 Z.ai 开发、基于 GLM-5.3 模型的桌面编程代理,评估了其功能、工作流程、成本以及在真实项目中的性能。
ZCode 是 Z.ai 的桌面编程代理。用户给代理一个任务,它会规划工作、编辑文件、运行命令、使用浏览器并检查结果。任务可以并行运行,用户可以安排定期工作。代理可以在 macOS、Windows 或 Linux 上运行,同时从移动设备进行控制。
查看缓存全文
缓存时间: 2026/09/01 23:40
# 深入解析 ZCode
来源:https://flaviocopes.com/zcode/
主页 (https://flaviocopes.com/)/AI (https://flaviocopes.com/tags/ai/) 作者
2026年8月31日,我在真实项目中试用了搭载 GLM-5.3 的 ZCode。本文将介绍该编程智能体的工作原理、成本、权限模式、自动化功能、API 以及使用限制。
---
ZCode 是 Z.ai 的桌面编程智能体。
我将其安装在 Mac 上,并指向本站的代码仓库,想看看它如何处理真实项目而非小型演示。
初步效果不错:应用响应迅速,工作流程清晰,GLM-5.3 在包含超过 1,700 篇文章的代码库中发现了有用的改进点。
让我们看看它具体如何运作。
## ZCode 是什么?
ZCode (https://zcode.z.ai/en) 支持 macOS、Windows 和 Linux 系统。
Z.ai 称其为“智能体开发环境”(Agentic Development Environment,ADE)。它并非 VS Code 的分支,也没有传统代码编辑器。
你将任务交给智能体,它会规划工作、编辑文件、执行命令、使用浏览器并检查结果。
```
任务
→ 规划
→ 编辑文件、执行命令、使用浏览器
→ 验证结果
→ 审核
```
任务会整合所有内容:你的目标、修改的文件、终端输出、浏览器上下文及 Git 状态。
你还可以并行运行任务、调度重复性工作,并通过手机控制 ZCode。
## Z.ai 与 GLM-5.3
Z.ai 是智谱 AI 的国际名称。这家北京 AI 实验室脱胎于清华大学的研究。
它构建了 GLM 系列模型。与 OpenAI 和 Anthropic 不同,Z.ai 还发布可供下载和托管的模型权重。
ZCode 是其官方 GLM-5.3 调度平台。应用围绕模型构建,模型本身也针对此类智能体工作进行了调优。
Z.ai 提供 API 访问权限和 **GLM 编码计划**。同一订阅可用于超过 20 种编程智能体(包括 Claude Code)。
## GLM-5.3 有何不同?
GLM-5.3 于 2026 年 8 月 14 日发布。
它使用与 GLM-5.2 相同的基础模型,未进行新的预训练阶段。改进源于在更长工程任务上的后训练。
实际限制如下:
- 100 万 token 上下文窗口
- 128K 最大输出长度
- 三种推理层级:`low`、`high` 和 `max`
推理功能始终激活。你可以降低其强度,但不能完全禁用。更高的推理强度也会消耗更多计划配额。
## 模型如何训练?
Z.ai 在任务环境中训练了 GLM-5.3。
模型接收目标、工具和可验证的结果。它编写代码、运行代码,并根据任务是否通过进行学习。
某些环境模拟数天的工程工作。任务可能要求模型定位瓶颈、修复问题、运行实验并证明改进效果。
手工创建足够多的真实环境耗时过长。Z.ai 使用研究智能体收集工作模式并将其转化为可运行任务。另一个智能体则验证每个任务是否可解。
验证器无法看到参考解决方案,这使模型更难通过模仿预期形式来通过测试。
这种训练解释了 GLM-5.3 为何在 ZCode 中表现出色。它的设计目标就是持续处理长任务,无需你将每个步骤拆解。
## GLM-5.3 表现如何?
Z.ai 报告称,其内部编码基准测试中 GLM-5.3 比 GLM-5.2 提升 50%。
我不会过度看重单一公司的基准测试。公开结果显示了相似的提升:
基准测试 GLM-5.2 GLM-5.3
Terminal Bench 3.0 4.62 8.3
DeepSWE v1.1 46.2 66.9
Agents’ Last Exam 23.8 28.5
CyberGym 77.2% 84.5%
Z.ai 表示 GLM-5.3 在 Terminal Bench 3.0 和 Agents’ Last Exam 中领先于开源模型。
与闭源模型的对比则不那么显著。
在 Z.ai 的 Code Bench 中,GLM-5.3 在高推理强度下得分为 31.4%,每个任务平均输出约 5 万 token。Claude Opus 4.8 以约 12 万 token 得分 29.5%。
GLM-5.3 在最大推理强度下达到 34.5%,而 Claude Fable 5 以 39.5% 保持领先。
因此,这并非当前最佳编码模型。但它以更少 token 和更低成本接近了顶尖水平。
## 安全性为何重要?
GLM-5.3 在训练过程中异常擅长发现安全问题。
它在 CyberGym 上获得 84.5% 的评分。Z.ai 称这是该基准测试迄今最佳成绩。其漏洞利用得分也比 GLM-5.2 翻了一倍多,尽管闭源模型仍处于领先地位。
Z.ai 随后与安全团队在真实项目中合作。该模型在 269 个项目中发现 2,436 个漏洞,其中包括 1,097 个中高危问题。
某些漏洞在代码库中存在了数十年。Z.ai 在公开的安全披露日志中追踪这些报告。
该能力推迟了开源权重的发布。GLM-5.3 在发布前又进行了两周的风险审查。
## 开源权重与许可
你可以从 Hugging Face (https://huggingface.co/zai-org/GLM-5.3) 下载 GLM-5.3 权重。Z.ai 于 2026 年 8 月 28 日发布。
GLM-5.2 使用 MIT 许可证,GLM-5.3 则使用自定义许可证。
你仍可使用、修改、分发、销售、部署和微调模型。额外条件适用于年收入超过 100 亿美元的模型托管公司,它们需要接受 Z.ai 的安全审查。
这不会影响大多数开发者。但开源权重不再意味着 MIT 许可。在围绕该模型构建产品前,请务必阅读许可条款。
## GLM-5.3-Flash 是什么?
Z.ai 在主权重发布两天前推出了 **GLM-5.3-Flash**。Flash 采用 MIT 许可证。
它是首个原生多模态 GLM-5 模型,可分析图像和截图。
Flash 拥有 3200 亿总参数,每个 token 激活 180 亿参数。其混合专家设计降低了推理成本。
它结合了稀疏和线性注意力机制,降低了处理长上下文的成本。
Flash 的成本约为 GLM-5.3 的十分之一。在编码计划中,它能提供三倍可用配额。
ZCode 使用它处理视觉任务。智能体可以打开页面、检查结果并验证自身修改。
## 安装前的隐私说明
使用编码计划时,ZCode 会将你的提示词和相关代码发送至 Z.ai。
Z.ai 是一家中国公司。你的公司可能对将专有代码或客户数据发送至其基础设施有相关规定。
对于公开项目和个人实验,我愿意尝试。但在用于私人客户项目前,我会确认相关政策。
你可以通过自行运行开源权重来避免使用托管服务。但这实际需要高性能硬件,我们稍后会再讨论。
## 安装 ZCode
从 zcode.z.ai (https://zcode.z.ai/en) 下载应用。
ZCode 网站显示 macOS 应用下载按钮
在 Apple Silicon Mac 上,你会获得 `.dmg` 文件。打开它并将 ZCode 拖入应用程序文件夹。
ZCode 安装程序窗口显示应用图标和应用程序文件夹
Windows 安装程序可用。Linux 版本目前处于测试阶段。
## 连接账户
首次启动时,ZCode 要求连接账户。
ZCode 欢迎屏幕显示账户连接选项
你可以连接到:
- **Z.ai**(全球服务)
- **BigModel**(中国大陆服务)
- 自有 API 密钥
对于中国以外的大多数用户,请选择 Z.ai。
新用户目前可获得五天试用期,包含每日 GLM-5.3 和 GLM-5-Turbo 配额。
试用期后,你需要 GLM 编码计划:
- Lite 版每月 18 美元
- Pro 版每月 80 美元(包含六倍用量)
- Max 版每月 168 美元(包含 14 倍用量)
我查看时这三个计划均有七折优惠。
用量通过点数计算。非高峰时段和周末的调用消耗减半。
## ZCode 主界面
连接后,你将进入此界面:
ZCode 主界面包含侧边栏、提示框和建议标签
侧边栏包含你的项目和任务,还提供搜索、自动化功能和插件市场。
应用中心是一个提示框。使用 `@` 添加上下文,使用 `/` 运行命令。
ZCode 还内置终端。点击右上角的终端图标打开它。
ZCode 内置终端面板在窗口底部打开
## 选择模型
模型选择器位于提示框下方。
ZCode 模型下拉菜单显示 GLM-5.3、GLM-5.3-Flash 和 GLM-5-Turbo
你可以选择:
- **GLM-5.3** 处理复杂编码任务
- **GLM-5.3-Flash** 加速工作并处理视觉任务
- **GLM-5-Turbo** 回答快速问题
GLM-5.3 还要求选择推理强度。
我在架构设计、调试和多文件处理时使用 Max。对于重命名、小修改和提问,Low 强度已足够。
如果不确定,请从低强度开始。你可以重新运行任务并提高强度。在小编辑上消耗大量配额更难挽回。
## 选择权限模式
这是我首先检查的设置。
ZCode 权限模式下拉菜单显示四种执行模式
ZCode 有四种权限模式:
- **修改前询问**:编辑文件前询问
- **自动编辑**:直接修改文件无需询问
- **计划模式**:编辑前显示计划
- **完全访问**:移除更多确认步骤
请从 **修改前询问** 开始。
虽然需要批准更多操作,但你能看到智能体的意图。当信任其在该项目中的表现后,可切换至自动编辑。
对大型修改使用计划模式。阅读计划只需一分钟,而在大型差异中找出错误假设则耗时更长。
我会将完全访问模式用于临时项目。无论使用何种模式,请始终使用 Git。我的[免费 Git 课程](https://flaviocopes.com/courses/git/)涵盖基础知识(如需参考)。
## 执行真实任务
我选择了 flaviocopes.com 仓库,并给 ZCode 以下任务:
```
查看最近发布的文章,分析是否可以改进,
建议最多4项优化措施
```
ZCode 在 flaviocopes.com 仓库上开始任务
智能体开始读取仓库。由于我使用了“修改前询问”模式,它在执行 shell 命令前暂停了。
ZCode shell 命令权限批准卡片
我可以选择允许单次执行、允许该模式在项目中使用或拒绝。这让你可以逐步授予权限,而非提前批准所有操作。
我批准了命令。ZCode 找到最新文章,阅读它,并与网站其他内容对比。
ZCode 任务结果显示四项具体改进建议
它发现了死链接、缺少目录的长章节以及时区不一致问题。
首个任务就完成了有价值的工作。
提示词的写法也有帮助:我给出了一个目标和明确限制。对于编程智能体,我尽量:
- 每个任务只设一个目标
- 用 `@` 指向证据
- 说明智能体如何验证结果
## 使用“目标”处理长期工作
普通任务是一段对话,而 **目标** 会持续向结果推进。
ZCode 循环执行规划、执行和验证。它会在工作中更新计划,而非得到第一个答案就停止。
这正是 GLM-5.3 长任务训练发挥优势的地方。
我仍会为“目标”设置可验证的结果。“让测试套件通过”可行,“让应用更好”则不行。
## 添加插件
插件市场提供了新功能。
ZCode 插件市场显示已安装插件和可用分类
插件可封装技能、命令和 MCP 服务器。当前目录包括浏览器自动化、Android 模拟、视频工具以及 DOCX/PDF 文档生成。
如果 MCP 对你来说是新概念,请阅读[什么是 MCP(模型上下文协议)](https://flaviocopes.com/what-is-mcp/)。
## 调度自动化
自动化是 ZCode 较有趣的功能之一。
ZCode 自动化界面显示预设任务模板
你可以调度重复性任务或排队后续工作。
内置模板展示了理念:晨间开发简报、每日风险扫描、发布简报和文档同步检查。
非高峰时段调用消耗减半点数。Z.ai 还为订阅者推出空闲时间任务,这些任务在有空闲容量时运行且不消耗计划配额。
我会将自动化用于不需要即时结果的工作:
- 检查最近修改页面的断链
- 扫描本周变更的安全问题
- 准备周五工作总结
安全扫描会是我的首选。漏洞发现是 GLM-5.3 最强的能力之一。
## 通过手机控制 ZCode
ZCode 提供 **远程** 和 **机器人频道**。
远程功能通过扫描二维码将桌面应用镜像到手机。
机器人频道将 ZCode 连接到微信、飞书或 Telegram。你可以通过聊天检查任务、启动新任务、切换项目、更改模型和选择运行模式。
会话仍在桌面运行,代码保留在本机。
我喜欢这个想法。智能体长时间运行时常因一个问题而中断。用手机回答比两小时后发现任务阻塞要好。
## 使用编码计划配合 Claude Code
你不会被锁定在 ZCode 中。Z.ai 记录了超过 20 种工具的编码计划。
配置 Claude Code 最快的方式是使用 Z.ai 的助手:
```
npx @z_ai/coding-helper
```
你也可以自行编辑 `~/.claude/settings.json`:
```
{
"env": {
"ANTHROPIC_AUTH_TOKEN": "你的编码计划API密钥",
"ANTHROPIC_BASE_URL": "https://api.z.ai/api/anthropic",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.3",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.3",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "glm-5.3-flash",
"CLAUDE_CODE_AUTO_COMPACT_WINDOW": "1000000",
"API_TIMEOUT_MS": "3000000"
}
}
```
三个模型设置将 Claude Code 路由到 GLM。压缩窗口允许在总结前使用更多 100 万上下文。
长超时时间防止高推理强度请求过早结束。
使用上述精确端点。错误的基础 URL 即使订阅有效也可能产生 `1113 Insufficient Balance` 错误。
运行 `claude`,然后打开 `/status`。检查基础 URL 和模型是否正确。
## 在 Node.js 中调用 GLM-5.3
Z.ai API 与 OpenAI API 兼容。
以下是使用 `fetch()` 的直接请求示例:
```
const response = await fetch('https://api.z.ai/api/paas/v4/chat/completions', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
Authorization: `Bearer ${process.env.ZAI_API_KEY}`,
},
body: JSON.stringify({
model: 'glm-5.3',
messages: [
{ role: 'user', content: '检查此函数的安全性问题:...' },
],
reasoning_effort: 'high',
}),
})
const data = await response.json()
console.log(data.choices[0].message.content)
```
`reasoning_effort` 接受 `low`、`high` 或 `max`,默认为 `max`。
思考功能无法禁用。旧代码可能发送 `thinking.type: "disabled"`。需改为 `enabled` 并使用 `reasoning_effort: "low"`,否则请求将失败。
API 还支持流式处理、函数调用、结构化输出和上下文缓存。
## 你能自行运行 GLM-5.3 吗?
可以,但需要高性能硬件。
Z.ai 在 Hugging Face 页面提供了 vLLM 和 SGLang 的部署指南。GLM-5.3 需要多 GPU 服务器。
当公司需要完全控制数据且具备运行模型的基础设施时,自托管是合理选择。
对其他人而言,开源权重仍然重要。其他提供商可以托管模型,且 Z.ai 无法在发布后移除它。
## ZCode 对比如何?
Claude Code 在终端运行,ZCode 提供桌面应用、自动化和手机控制。
Claude Code 拥有更成熟的生态系统,支持自定义子智能体。ZCode 目前不支持。你可以用同一编码计划同时使用两者。
Cursor 等工具包含代码编辑器,ZCode 则没有。它更适合希望智能体编写而自己审核的用户。
相似文章
ZCode(1分钟阅读)
ZCode现已支持macOS、Windows和Linux系统,集成了AI代理用于规划、编码、审查和部署,深度整合GLM-5.2并提供分层定价方案。
ZCode – GLM-5.2 适配工具
ZCode 是一款针对 GLM-5.2 优化的编程适配工具,提供智能体编码功能,包括长时间运行任务、通过消息应用控制机器人,以及多种定价层级。
Z.ai 推出 ZCode,挑战 Cursor、Claude Code 和 GitHub Copilot 的 AI 编程工具
Z.ai 推出 ZCode,这是为其 GLM-5.2 模型打造的代理式开发环境,凭借深度集成、多设备支持和有竞争力的定价,挑战现有的 AI 编程工具。
ZCode: Claude Code from the Makers of GLM
ZCode是一款由GLM团队推出的AI编程开发工具,深度适配GLM-5.2模型,提供长程任务管理和远程Bot控制等功能,支持多种订阅计划。
有人将Z.ai的GLM-5.2集成到一款开源的Claude Code Python重构版中
ClawCodex(一款开源的Claude Code Python重构版)现已将Z.ai的GLM-5.2作为一级提供商支持,并附带演示:一次调用便构建出FIFA World Cup 2026介绍页面。