AI Gateway

统一协议、多上游路由、自动故障转移与透明 Token 计费。

AI Gateway 通过 https://ai.xapi.to 统一调用 Claude、GPT、Gemini、DeepSeek、 Kimi 等主流模型。应用使用 Anthropic Messages 或 OpenAI Chat Completions 协议, 无需适配 xAPI 私有请求格式。

工作机制

同一模型可以由多个上游提供。Gateway 根据所选策略和实时健康状态选择上游, 在限频、超时或服务异常时切换备用源,并通过响应头返回实际路由和计费信息。

协议兼容

支持 Anthropic Messages 与 OpenAI Chat Completions;现有 SDK 通常只需修改 Base URL 和 API Key。

多上游路由

使用 qualityspeedcost 策略,在健康供应商中选择质量、速度或价格 更合适的路径。

自动故障转移

上游限频、5xx 或超时时尝试备用源。可通过 X-Routing-ProviderX-Routing-Attempts 等响应头核对路由。

透明计费

按实际输入、输出和缓存 Token 结算;非流式请求通过 X-AI-Cost 返回本次费用。

接入方式

用法Base URL适合场景
Anthropic 协议https://ai.xapi.toClaude Code、Anthropic SDK
OpenAI 协议https://ai.xapi.to/v1OpenAI SDK、Codex、DeepSeek 等模型
指定策略https://ai.xapi.to/{strategy}/v1显式选择 quality / speed / cost
直连上游https://{host}.p.xapi.to/v1必须锁定某个供应商时

适用场景

  • 为现有 OpenAI 或 Anthropic 应用增加多供应商容灾
  • 在 Claude Code、Codex、Cursor、Cline 等开发工具中统一使用一个 API Key
  • 在成本、速度和质量之间按请求选择路由策略
  • 使用 DeepSeek、Claude、GPT、Gemini 等不同模型而不更换客户端协议
  • 通过流式响应、Tool Calling 和多模态能力构建 AI 应用

下一步

AI Gateway 不负责执行 Shell 或管理云实例。需要隔离代码执行、文件、端口或 GPU 时, 请使用独立的 Sandbox 产品。