Gemini API 托管代理:3.6 Flash、钩子等更多功能

Google AI Blog 产品

摘要

谷歌宣布了 Gemini API 中托管代理的更新,包括默认使用 Gemini 3.6 Flash 模型、用于工具调用审计的环境钩子、预算控制、定时触发器和免费层级访问。

<img src="https://storage.googleapis.com/gweb-uniblog-publish-prod/images/unnamed_2_vNnOv20.max-600x600.format-webp.webp">我们宣布在 Gemini API 的托管代理中推出更多新功能,让开发者能够构建可靠、可用于生产的代理。
查看原文
查看缓存全文

缓存时间: 2026/07/28 18:26

# Gemini API 托管代理:3.6 Flash、钩子与更多更新 来源:https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api-3-6-flash-hooks/ Gemini API 中的托管代理现已默认使用 Gemini 3.6 Flash。新增的环境钩子让您可以在沙箱内部拦截、检查或审计工具调用。此外,我们还增加了预算控制、定时触发器和免费层访问权限。 --- Google DeepMind 技术人员 Mariano Cocirio Google DeepMind 产品经理 --- ## 托管代理:Gemini 3.6 Flash、钩子与触发器 您的浏览器不支持音频元素。 收听文章 [[时长]] 分钟 此内容由 Google AI 生成。生成式 AI 具有实验性。 Gemini API 中的[托管代理](https://ai.google.dev/gemini-api/docs/agents)现支持[环境钩子](https://ai.google.dev/gemini-api/docs/agent-hooks)、[模型选择](https://ai.google.dev/gemini-api/docs/antigravity-agent#model-selection)以及[免费层访问](https://ai.google.dev/gemini-api/docs/pricing#pricing-for-agents)。这些功能基于我们之前发布的[后台任务和远程 MCP 服务器集成](https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api/)之上。 借助 [Gemini Interactions API](https://ai.google.dev/gemini-api/docs/interactions-overview) 中的托管代理,仅需一次 API 调用,即可在隔离的云端沙箱中协调推理、代码执行、包安装、文件管理和网页检索。 如果您正在使用 AI 编程助手,请在终端中运行以下命令,使其具备 Interactions API 技能: `npx skills add google-gemini/gemini-skills --skill gemini-interactions-api` 以下示例使用 `@google/genai` TypeScript/JavaScript SDK。如需 Python 或 cURL 版本,请查看[反重力代理文档](https://ai.google.dev/gemini-api/docs/antigravity-agent)。 `` npm install @google/genai `` ## Gemini 3.6 Flash 现已设为默认模型 `antigravity-preview-05-2026` 代理现在默认运行 [Gemini 3.6 Flash](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/)。您无需修改任何代码,下次交互即会自动生效。 您也可以通过创建交互或托管代理时传入 `agent_config.model` 来显式选择模型。如需更低成本,可使用 Gemini 3.5 Flash-Lite,或固定为您偏好的模型。 `` import { GoogleGenAI } from "@google/genai"; const client = new GoogleGenAI({}); const interaction = await client.interactions.create({ agent: "antigravity-preview-05-2026", input: "审计 package.json 中的所有依赖项,升级过时的包,并通过运行 npm test 验证构建。", environment: "remote", agent_config: { type: "antigravity", model: "gemini-3.5-flash-lite", }, }); console.log(interaction.output_text); `` 支持的模型包括: - **Gemini 3.6 Flash**(`gemini-3.6-flash`,默认):适用于推理、编码和工具调用的均衡模型。 - **Gemini 3.5 Flash**(`gemini-3.5-flash`):适用于通用代理工作流的上一代模型。 - **Gemini 3.5 Flash-Lite**(`gemini-3.5-flash-lite`):Gemini 3.5 系列中延迟和成本最低的模型。 ## 环境钩子:在沙箱内部拦截、检查并审计工具调用 [环境钩子](https://ai.google.dev/gemini-api/docs/agent-hooks)允许您在代理在其沙箱中每次进行工具调用之前或之后运行自定义脚本。在您的环境中添加一个 `.agents/hooks.json` 文件,运行时将在 `pre_tool_execution` 或 `post_tool_execution` 事件上执行您的处理程序。 `matcher` 字段支持正则表达式,允许您使用 `|` 定位多个工具,或使用 `*` 捕获所有工具: `` { "security-gate": { "pre_tool_execution": [ { "matcher": "code_execution|write_file", "hooks": [ { "type": "command", "command": "python3 /.agents/hooks-scripts/gate.py", "timeout": 10 } ] } ] }, "auto-format": { "post_tool_execution": [ { "matcher": "*", "hooks": [ { "type": "command", "command": "python3 /.agents/hooks-scripts/auto_lint.py", "timeout": 15 } ] } ] } } `` 在此配置中: - `security-gate` 组会在每次 `code_execution` 或 `write_file` 调用前运行 `gate.py`。如果脚本返回 `{"decision": "deny", "reason": "..."}`,则跳过该工具调用,并将拒绝原因传递给模型的上下文。 - `auto-format` 组在每次工具完成后运行 `auto_lint.py`,以强制执行代码样式。 - 钩子还支持 `http` 类型的处理程序,可直接 POST 数据到外部端点。 有关完整的 HTTP 钩子定义和失败处理语义,请参阅[钩子文档](https://ai.google.dev/gemini-api/docs/agent-hooks)。 团队已经在使用钩子构建生产级别的验证管道。例如,AI 原生投资银行 OffDeal 使用 `post_tool_execution` 钩子在远程沙箱内运行自动图像验证。 > “OffDeal 是一家 AI 原生的投资银行,Archie 是我们的银行家每天使用的 AI 分析员。银行家可用的演示文稿要求包括公司徽标:购买表、赞助商栏、墓碑网格,单个演示文稿中通常有 30 多个徽标,每个徽标必须对应正确的公司、大小和宽高比合适、包含公司名称、背景透明,并且在白色幻灯片上具有高对比度。 > > 在代理钩子出现之前,我们无法在 Gemini 的托管代理上做到这一点:沙箱是远程的,我们的验证代码无处可运行。有了钩子,post_tool_execution 钩子会在 Archie 写入公司列表的那一刻触发我们的管道,在沙箱内获取候选徽标,执行像素级质量检查,使用 Gemini 视觉验证每个徽标,并发布一个已批准文件的清单,只有这些图像才允许进入演示文稿。” > > — Alston Lin,OffDeal 创始人兼 CTO ## 成本控制与自动化功能 ### 免费层可用性 托管代理现已对[免费层项目](https://ai.google.dev/gemini-api/docs/pricing#pricing-for-agents)开放。开发者可以使用[未激活计费的项目 API 密钥](https://ai.google.dev/gemini-api/docs/api-key)来试验代理工作流。 ### 预算控制 由于托管代理会执行多轮自主循环,复杂任务可能会消耗大量 token 预算。为了防止任务失控,您可以在 `agent_config` 中传入 `max_total_tokens` 来限制总消耗量(输入 + 输出 + 思考)。 当代理达到限制时,执行会安全暂停,交互返回 `status: "incomplete"`。环境状态得以保留,您可以通过传入 `previous_interaction_id` 和新的预算来[从中断处继续执行](https://ai.google.dev/gemini-api/docs/antigravity-agent#continuing-incomplete-interaction)。 `` const interaction = await client.interactions.create({ agent: "antigravity-preview-05-2026", input: "审计此仓库中的所有模块并生成迁移报告。", agent_config: { type: "antigravity", max_total_tokens: 10000, }, environment: "remote", }); `` ### 定时触发器执行 通过[定时触发器](https://ai.google.dev/gemini-api/docs/antigravity-agent#triggers)自动化重复的代理任务。触发器将代理、环境、提示和 cron 计划绑定为一个持久化资源,无需手动干预即可触发。每次运行都会复用同一个沙箱,因此文件在多次执行间保持持久。 ### 环境 API [环境 API](https://ai.google.dev/gemini-api/docs/agent-environment#environments-api) 允许您通过代码列出、检查和删除沙箱会话。在断开连接后恢复环境 ID,或者在管道完成后清理沙箱,无需等待 7 天 TTL。 ## 开始使用托管代理 这些更新将托管代理转变为成本可控、定时运行的自动化工作者,它们能在真实的开发环境中自主运行,既不会超出预算,也无需外部编排。 请查看 [Gemini Interactions API 概述](https://ai.google.dev/gemini-api/docs/interactions-overview)和[托管代理快速入门](https://ai.google.dev/gemini-api/docs/managed-agents-quickstart),了解更多关于自定义代理定义、环境配置、网络规则和高级流式传输模式的信息。

相似文章

Gemini 3.7 Flash

Hacker News Top

Google 推出 Gemini 3.7 Flash,这是其用于编码和智能体(agents)的最智能的主力模型,在软件工程、Web 开发和知识工作方面有显著改进,且定价为 Gemini 3.6 Flash 首发价的一半。

Gemini 2.5:思维模型家族的更新

Google DeepMind Blog

Google 宣布 Gemini 2.5 Pro 和 Flash 模型的稳定正式发布,推出新的 Gemini 2.5 Flash-Lite 预览版,具有更低的延迟和成本,并更新 Flash 系列的定价,调整输入/输出令牌费率。