一次请求,
在网关里走过五站。

从你的代码发出请求,到结果返回、用量入账,中间发生了什么?往下滚动,看它一站一站走完。

01

发出请求

你的应用用标准的 OpenAI 格式发请求,地址是 api.mallowapi.com/v1,带上 sk- 开头的密钥。换模型只改 model 一个字段。

02

鉴权和额度

网关先核对密钥:是否有效、有没有过期、IP 是否允许、额度和余额够不够。不通过就直接返回明确的错误码,不会发到上游,也不会扣费。

03

选择上游

按密钥所在的分组,从健康的上游账号里挑一个。同一段对话会尽量留在同一个账号上,这样更容易命中缓存,缓存部分更便宜。

04

出错自动改道

如果这个上游限流或超时,网关会把它暂时摘除,把同一个请求转给另一个健康账号。你的代码里不用写重试,流式输出照常返回。

05

记录和计费

按实际用掉的 token 计费:官方价 × 平台倍率 × 7,从余额里扣。每次请求都能在控制台「使用记录」查到模型、用量和金额。

分工很简单

    你要做的

  • 在控制台建一把密钥
  • 把 base_url 和密钥填进工具或代码
  • 选一个模型名

    网关替你做的

  • 鉴权、额度和余额检查
  • 挑健康的上游,保持会话
  • 上游出错时自动换账号重试
  • 逐条记录用量并按 token 计费

看完了?三步就能接上。

Codex、CC Switch、Cherry Studio、Cursor、Python、Node.js 都有现成的步骤。

去看接入方法