AI模型路由的统一API(3分钟阅读)
摘要
Google Cloud API Gateway 现已在公开预览版中提供模型路由,提供一个无服务器入口层,可接受兼容 OpenAI 的请求,并动态路由到 Gemini、Claude 或 OpenAI 模型。
Google Cloud API Gateway 上的模型路由现已公开预览。该 API 网关提供了轻量级、无服务器的入口层,可接受兼容 OpenAI 的请求,并动态地将它们路由到 Gemini、Claude 或 OpenAI OSS-GPT。它可以独立用于简单的速率限制和令牌跟踪,也可以与 Gemini Enterprise Agent Platform 无缝配对使用。本文包含有关如何配置路由逻辑的分步指南。
查看缓存全文
缓存时间: 2026/08/05 13:32
# AI 模型路由的统一 API
来源:https://developers.googleblog.com/a-unified-api-for-ai-model-routing/
- 社区/活动 (https://developers.google.com/community)
- 学习 (https://developers.google.com/solutions/catalog)
- 博客 (https://developers.googleblog.com/)
- YouTube (https://www.youtube.com/user/GoogleDevelopers)
在构建 AI 应用时,开发者需要能够自由地将流量路由到最适合任务的模型,而无需硬编码端点或管理开源代理。Google Cloud API Gateway (https://docs.cloud.google.com/api-gateway/docs) 现在以公开预览版提供模型路由来解决这一问题。它提供了一个轻量级、无服务器的入口层,可接受 OpenAI 兼容请求,并动态地将它们路由到 Gemini、Claude 或 OpenAI OSS-GPT。
API Gateway 可以独立使用,用于简单的速率限制和令牌跟踪,也可以与 Gemini Enterprise Agent Platform 无缝配合。例如,您可以将代理的出站流量通过 Agent Gateway 路由,以实现严格的安全治理,然后让请求进入 API Gateway 处理到 Google 托管的 LLM 的动态路由。以下是一份关于如何配置路由逻辑的分步指南。
### **路由您的流量**
设置您的模型路由逻辑只需几个步骤:
1. **配置路由规则:** 您可以直接在 OpenAPI 3.x 规范中使用新的 `x-google-api-management` 扩展块,将虚拟模型名称映射到特定的后端目标。
``
openapi: 3.0.4
info:
title: OpenAPI 3.x spec using Model Routing
description: Using Model Routing in an OAS 3.x spec
version: 1.0.0
x-google-api-management:
backends:
gemini-35-flashlite:
address: >-
https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/publishers/google/models/gemini-3.5-flash-lite:generateContent
deadline: 60.0
pathTranslation: CONSTANT_ADDRESS
anthropic-claude-opus-47:
address: >-
https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/publishers/anthropic/models/claude-opus-4-7:rawPredict
deadline: 60.0
pathTranslation: CONSTANT_ADDRESS
openai-gpt-oss-120b:
address: >-
https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/endpoints/openapi/chat/completions
deadline: 60.0
pathTranslation: CONSTANT_ADDRESS
ai:
models:
routing:
routers:
# Router 1: route between Gemini (default) and Claude.
gemini-claude-router:
defaultModel:
backend: gemini-35-flashlite
targetModel: google/gemini-3.5-flash-lite
rules:
- model: "claude-opus-4-7"
backend: anthropic-claude-opus-47
targetModel: anthropic/claude-opus-4-7
# Router 2: route between OpenAI GPT (default) and Gemini.
openai-gemini-router:
defaultModel:
backend: openai-gpt-oss-120b
targetModel: openai/gpt-oss-120b-maas
rules:
- model: "gemini-3.5-flash-lite"
backend: gemini-35-flashlite
targetModel: google/gemini-3.5-flash-lite
servers:
- url: "https://my-gateway-url.com"
paths:
/v1/chat/gemini-claude:
post:
summary: "Endpoint:defaults to Gemini & Claude as an option."
operationId: "chatGeminiClaude"
x-google-model-router: gemini-claude-router
responses:
'200':
description: "OK"
/v1/chat/openai-gemini:
post:
summary: "Endpoint:defaults to OpenAI & Gemini as an option."
operationId: "chatOpenAIGemini"
x-google-model-router: openai-gemini-router
responses:
'200':
description: "OK"
``
YAML
已复制
**注意:** 单个路由器引用的所有后端必须共享同一主机(例如,aiplatform.googleapis.com)。路由会在该共享 Vertex 主机上选择不同的模型和路径——它不会在不同主机之间进行路由。
2. **部署网关:** 部署更新后的 API 配置,使网关处于活动状态并准备好处理流量。
3. **发送标准请求:** 您的应用只需发送一个标准的 OpenAI `POST /v1/chat/gemini-claude` 或 `POST /v1/chat/openai-gemini` 请求。网关会拦截该请求,将有效载荷转码为后端的原生模式,并实时路由。例如(为 `$API_KEY` 和 `my-gateway-url.com` 使用合适的值):
``
curl -X POST "https://my-gateway-url.com/v1/chat/gemini-claude" \
-H "content-type: application/json" \
-H "x-api-key: $API_KEY" \
-d '{
"model": "claude-opus-4-7",
"messages": [
{"role": "user", "content": "Introduce yourself in 5 words"}
]
}'
``
Shell
已复制
### **开始使用**
模型路由现已作为 API Gateway 的公开预览版提供。为了不再管理代理,并开始统一您的 AI 流量,请查看我们的文档 (https://docs.cloud.google.com/api-gateway/docs/model-routing-overview),立即部署您的第一个模型路由器。
相似文章
@googledevs:不再有硬编码端点。API Gateway 的模型路由现已进入公开预览!通过单个端点即可访问 Gemini、Claude 和 OSS 模型……
Google Cloud API Gateway 宣布模型路由公开预览,让开发者通过使用 OpenAPI 规范的单一端点访问 Gemini、Claude 和 OSS 模型。
我们为AI智能体构建了一个统一API网关——经验教训
我们为AI智能体构建了一个统一API网关,通过单个兼容OpenAI的端点支持Claude、GPT、Codex、Gemini等多种模型。它简化了构建AI智能体和SaaS产品的开发者的集成、计费和部署流程。
@rauchg: 我们一直将AI Gateway解释为一种~~内容~~令牌分发网络。就像AI模型的CDN。一个绝妙的功能…
Vercel的AI Gateway现在支持路由规则,允许开发者无需修改代码即可动态重写模型路由(例如,从已弃用的模型如Claude Fable-5切换到Claude Opus-5),确保生产工作负载保持弹性。
OpenAI API
OpenAI 宣布发布 API,用于通过通用文本界面访问其 AI 模型。该 API 以私密测试版的形式推出,采用严格的安全措施,包括强制性的生产审查和内容限制,以防止有害用途。
ngrok AI Gateway
ngrok 推出其 AI Gateway,这是一个统一的私有网关,旨在为多种 AI 模型提供统一访问。