AI模型路由的统一API(3分钟阅读)

TLDR AI 产品

摘要

Google Cloud API Gateway 现已在公开预览版中提供模型路由,提供一个无服务器入口层,可接受兼容 OpenAI 的请求,并动态路由到 Gemini、Claude 或 OpenAI 模型。

Google Cloud API Gateway 上的模型路由现已公开预览。该 API 网关提供了轻量级、无服务器的入口层,可接受兼容 OpenAI 的请求,并动态地将它们路由到 Gemini、Claude 或 OpenAI OSS-GPT。它可以独立用于简单的速率限制和令牌跟踪,也可以与 Gemini Enterprise Agent Platform 无缝配对使用。本文包含有关如何配置路由逻辑的分步指南。
查看原文
查看缓存全文

缓存时间: 2026/08/05 13:32

# AI 模型路由的统一 API 来源:https://developers.googleblog.com/a-unified-api-for-ai-model-routing/ - 社区/活动 (https://developers.google.com/community) - 学习 (https://developers.google.com/solutions/catalog) - 博客 (https://developers.googleblog.com/) - YouTube (https://www.youtube.com/user/GoogleDevelopers) 在构建 AI 应用时,开发者需要能够自由地将流量路由到最适合任务的模型,而无需硬编码端点或管理开源代理。Google Cloud API Gateway (https://docs.cloud.google.com/api-gateway/docs) 现在以公开预览版提供模型路由来解决这一问题。它提供了一个轻量级、无服务器的入口层,可接受 OpenAI 兼容请求,并动态地将它们路由到 Gemini、Claude 或 OpenAI OSS-GPT。 API Gateway 可以独立使用,用于简单的速率限制和令牌跟踪,也可以与 Gemini Enterprise Agent Platform 无缝配合。例如,您可以将代理的出站流量通过 Agent Gateway 路由,以实现严格的安全治理,然后让请求进入 API Gateway 处理到 Google 托管的 LLM 的动态路由。以下是一份关于如何配置路由逻辑的分步指南。 ### **路由您的流量** 设置您的模型路由逻辑只需几个步骤: 1. **配置路由规则:** 您可以直接在 OpenAPI 3.x 规范中使用新的 `x-google-api-management` 扩展块,将虚拟模型名称映射到特定的后端目标。 `` openapi: 3.0.4 info: title: OpenAPI 3.x spec using Model Routing description: Using Model Routing in an OAS 3.x spec version: 1.0.0 x-google-api-management: backends: gemini-35-flashlite: address: >- https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/publishers/google/models/gemini-3.5-flash-lite:generateContent deadline: 60.0 pathTranslation: CONSTANT_ADDRESS anthropic-claude-opus-47: address: >- https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/publishers/anthropic/models/claude-opus-4-7:rawPredict deadline: 60.0 pathTranslation: CONSTANT_ADDRESS openai-gpt-oss-120b: address: >- https://aiplatform.googleapis.com/v1/projects/YOUR_PROJECT_ID/locations/global/endpoints/openapi/chat/completions deadline: 60.0 pathTranslation: CONSTANT_ADDRESS ai: models: routing: routers: # Router 1: route between Gemini (default) and Claude. gemini-claude-router: defaultModel: backend: gemini-35-flashlite targetModel: google/gemini-3.5-flash-lite rules: - model: "claude-opus-4-7" backend: anthropic-claude-opus-47 targetModel: anthropic/claude-opus-4-7 # Router 2: route between OpenAI GPT (default) and Gemini. openai-gemini-router: defaultModel: backend: openai-gpt-oss-120b targetModel: openai/gpt-oss-120b-maas rules: - model: "gemini-3.5-flash-lite" backend: gemini-35-flashlite targetModel: google/gemini-3.5-flash-lite servers: - url: "https://my-gateway-url.com" paths: /v1/chat/gemini-claude: post: summary: "Endpoint:defaults to Gemini & Claude as an option." operationId: "chatGeminiClaude" x-google-model-router: gemini-claude-router responses: '200': description: "OK" /v1/chat/openai-gemini: post: summary: "Endpoint:defaults to OpenAI & Gemini as an option." operationId: "chatOpenAIGemini" x-google-model-router: openai-gemini-router responses: '200': description: "OK" `` YAML 已复制 **注意:** 单个路由器引用的所有后端必须共享同一主机(例如,aiplatform.googleapis.com)。路由会在该共享 Vertex 主机上选择不同的模型和路径——它不会在不同主机之间进行路由。 2. **部署网关:** 部署更新后的 API 配置,使网关处于活动状态并准备好处理流量。 3. **发送标准请求:** 您的应用只需发送一个标准的 OpenAI `POST /v1/chat/gemini-claude` 或 `POST /v1/chat/openai-gemini` 请求。网关会拦截该请求,将有效载荷转码为后端的原生模式,并实时路由。例如(为 `$API_KEY` 和 `my-gateway-url.com` 使用合适的值): `` curl -X POST "https://my-gateway-url.com/v1/chat/gemini-claude" \ -H "content-type: application/json" \ -H "x-api-key: $API_KEY" \ -d '{ "model": "claude-opus-4-7", "messages": [ {"role": "user", "content": "Introduce yourself in 5 words"} ] }' `` Shell 已复制 ### **开始使用** 模型路由现已作为 API Gateway 的公开预览版提供。为了不再管理代理,并开始统一您的 AI 流量,请查看我们的文档 (https://docs.cloud.google.com/api-gateway/docs/model-routing-overview),立即部署您的第一个模型路由器。

相似文章

OpenAI API

OpenAI Blog

OpenAI 宣布发布 API,用于通过通用文本界面访问其 AI 模型。该 API 以私密测试版的形式推出,采用严格的安全措施,包括强制性的生产审查和内容限制,以防止有害用途。

ngrok AI Gateway

Product Hunt

ngrok 推出其 AI Gateway,这是一个统一的私有网关,旨在为多种 AI 模型提供统一访问。