计费机制
计费机制
按 Token 计费、预扣 → 结算两阶段、API Key 限额。
定价模型
xAPI 所有 AI 端点采用 按 Token 动态定价(billingType: PER_TOKEN):
各模型独立定价。完整价格表参见 模型与价格。
调用生命周期
关键设计:预扣 → 结算两阶段 + Redis Lua 脚本原子操作, 既防止并发场景下的超扣,也避免上游异常时的资金占用。
阶梯定价
部分 Anthropic 模型在大上下文场景下有阶梯报价:
当单次请求的 prompt context 总量
(inputTokens + cacheCreationTokens + cacheReadTokens)
达到 inputTokenThreshold 时,整个请求按高价档计费。
缓存 Token 差异化
Claude 系支持 prompt caching,xAPI 按缓存类型独立计费:
cacheCreationInputTokens—— 首次缓存写入,单价约为输入价 × 1.25cacheReadInputTokens—— 缓存命中读取,单价约为输入价 × 0.10
OpenAI 的 cached_tokens 嵌套在 prompt_tokens 之内,
与 Anthropic 独立字段的语义不同。xAPI 在 token 解析阶段统一归一化,
保证 inputTokens 字段始终代表”非缓存的常规输入 token”。
API Key 余额限额
每个 sk-xapi-... 密钥可独立配置 balanceLimit(USD 上限):
典型使用场景:
- 团队环境:为成员、CI、Agent 分别签发密钥并独立限额, 防止单个密钥异常消耗影响整体余额
- 多项目隔离:每个项目独立限额,便于成本归集与异常隔离
usedBalance 字段实时记录该密钥累计已扣金额,可在控制台查询。
充值
在 xapi.to 控制台 → Billing 页面充值,支持:
- 加密货币:BSC 链上 USDT / USDC,通过 x402 协议自动确认到账
- 法币:Stripe 信用卡
失败请求的扣费规则
平台定价构成
xAPI 对外定价 = 各上游公开价 × 平台加价倍率:
旗舰模型客单价高,加价比例较低;低价模型需覆盖基础运维成本,加价比例略高。 成本价数据来源于各上游官方 pricing 页面,每周同步一次。