Kong AI Gateway 2.0 将 AI 原语(模型、提供者、代理、MCP 服务器)视为控制平面实体,解决传统 API 网关无法处理的非线性、代理循环流量。
- Token‑based 限流:按输入/输出 token 量计费,而非单纯请求次数。
- 语义保护:实时检查提示、路由模型并抽象凭证。
- 动态工具治理:在工具发现阶段过滤权限,防止未授权调用。
在 Google Cloud 上,Kong 通过 Kong Kubernetes Operator(KKO)在 GKE 上部署数据平面,并利用 Workload Identity 继承 IAM 角色;Cloud Run 服务被锁定在私有入口,所有请求先通过 Kong 进行鉴权与日志。
- Vertex AI 集成:通过 Workload Identity 直接获取 OAuth 令牌,支持标准与企业端点;可在网关层配置模型回退链(如 Gemini Ultra → Gemini Flash)。
- MCP 服务器聚合:将多工具命名空间合并为统一端点,代理发现时剔除无权限工具。
- 代理间治理:为跨微服务代理通信提供相互认证、执行图追踪与递归限流。
Kong AI Gateway 2.0 为多运行时(GKE、Cloud Run、Vertex AI)提供单一控制平面,统一身份、可观测性与成本治理,帮助企业构建安全、可扩展的 AI‑native 生态。
GitHub
#开发者 #工具 #KongAI #GoogleCloud #VertexAI #GKE #CloudRun
@DevToolboxHub







