Aioga
AI资讯 / 产品更新
返回 AI资讯

Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT

Google Developers Blog(RSS)Aioga 编辑团队2026-08-04T16:45:02.138Z热度 61

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无...

产品更新Google Developers Blog(RSS)

今日 AI 情报摘要

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。

网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。

中文正文 · AI 翻译

在构建 AI 应用程序时,开发者需要自由地将流量路由到最适合任务的模型,而无需硬编码端点或管理开源代理。Google Cloud API Gateway:https://docs.cloud.google.com/api-gateway/docs 现已在公开预览中提供模型路由功能,以解决此问题。它提供了一个轻量级、无服务器的入口层,可接受与 OpenAI 兼容的请求,并动态将其路由到 Gemini、Claude 或 OpenAI OSS-GPT。

Google for Developers
Model Routing via API Gateway _ Header

API Gateway 可独立使用,以实现简单的速率限制和令牌追踪,或者无缝地与 Gemini Enterprise Agent 平台配合使用。例如,您可以通过 Agent Gateway 路由您的代理出口流量以进行严格的安全管理,然后将请求传递给 API Gateway,以处理到 Google 托管的 LLM 的动态路由。这是配置路由逻辑的分步指南。

设置模型路由逻辑只需几个步骤:

注意:由单个路由器引用的所有后端必须共享同一个主机(例如 aiplatform.googleapis.com)。路由会在该共享的 Vertex 主机上选择不同的模型和路径——它不会跨不同主机进行路由。

2. 部署网关:部署更新后的 API 配置,使网关处于活动状态并准备处理流量。

3. 发送标准请求:您的应用程序只需发送标准的 OpenAI POST /v1/chat/gemini-claude 或 POST /v1/chat/openai-gemini 请求。网关会拦截请求、将负载转码为后端的本地模式,并实时路由。例如(请为 $API_KEY 和 my-gateway-url.com 使用适当的值):

API Gateway 的模型路由现已在公开预览中提供。要停止管理代理并开始统一您的 AI 流量,请查看我们的文档:https://docs.cloud.google.com/api-gateway/docs/model-routing-overview,以便今天就部署您的首个模型路由器。

如何使用 Google 微基准测试评估 TPU 性能

使用会话感知负载均衡扩展实时 AI 代理

Run Ray on TPU, Part 2: Ray AI libraries

在TPU上运行Ray,第2部分:Ray人工智能库

Agent and Model Evaluations in Gemini Enterprise Agent Platform are now GA

Gemini Enterprise Agent 平台中的代理和模型评估现已通用可用

情报判断

Aioga 编辑摘要

Google Cloud API Gateway 在公开预览阶段加入模型路由,可接收 OpenAI 兼容请求,并在共享 Vertex 主机上动态转码和路由至 Gemini、Claude 或 OpenAI OSS-GPT。

背景分析

开发者可在 OpenAPI 3.x 规范中配置虚拟模型名与后端目标的映射,减少硬编码端点或自行管理开源代理的需要。该网关也可用于简单限流和令牌跟踪。

Aioga 观点

Aioga 判断,这项更新的核心价值是以统一入口处理不同模型的请求格式和路由配置,而非实现任意供应商之间的跨主机调度;公开预览状态也意味着仍需谨慎评估。

影响与后续

对采用多个受支持模型的应用,这一功能可能简化调用层配置,并可与 Gemini Enterprise Agent Platform 配合。值得关注的是,单个路由器引用的后端必须共享同一主机。 开发团队可先依据官方文档部署测试路由,验证 OpenAI 兼容请求的转码与目标模型选择是否符合预期,并重点检查共享主机限制、限流及令牌跟踪配置。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: developers.googleblog.com

来源: Google Developers Blog(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-04T16:45:02.138Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无...

Google Developers Blog(RSS)2026-08-04T16:45:02.138Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。