xAI · 棉花糖 API 路由
grok-4.5
编码强档 · 500K 上下文
标准倍率读取中正在读取网关500K ctx模型级样本:暂无
GATEWAY HEARTBEAT · 全局读取中
OpenAI 兼容流式输出会话保持自动故障转移
目录已配置不等于当前模型一定可调度。当前后端只提供全局网关状态,尚未提供按模型拆分的成功率、延迟与吞吐;因此本页不会把全局状态伪装成模型健康度。
Pricing
定价
单位为每百万 Token(USD)。现价按标准线路折扣计算,原价作为对照。
输入—原价 — / 1M
输出—原价 — / 1M
缓存写入—/ 1M tokens
缓存读取—/ 1M tokens
Access capabilities
接入能力
以下是棉花糖 API 网关层提供的接入能力,不冒充上游模型官方能力清单。
Protocol
支持协议
使用 OpenAI 兼容格式。只改 base_url,其余 SDK 调用方式保持不变。
Chat Completions APIOpenAI 兼容格式展开接入参数
Base URL
https://api.mallowapi.com/v1Endpoint
POST /chat/completionsModel
grok-4.5curl https://api.mallowapi.com/v1/chat/completions \
-H "Authorization: Bearer $SUB2API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"messages": [{"role": "user", "content": "Hello"}],
"stream": true
}'Context & limits
上下文与限制
以下为上游官方 API 公布的规格,作为参考;经棉花糖 API 账号池中转后的实际限制以控制台与实时调用为准。
上下文窗口500K
最大输出 Token未公布
规格来源官方规格参考
可用线路标准倍率读取中
xAI 官方 API 规格(上下文 500,000 tokens · 输出 未公布),非棉花糖 API 实测承诺;超长上下文的实际可用性以账号池当日调度为准。
Gateway status
状态信息
下列数据直接来自 /api/status。它描述全局网关,不是该模型的独立 SLA。
全局网关读取中
健康账号—
全局延迟—
30 天可用率—
——0 ms
正在采样…
100%50%0%
正在采样…
趋势图为本页浏览器向 /api/status 的实测探测(往返延迟与可达性),反映你当前到网关的连通性;不是模型级 SLA,也不代表推理耗时。
更新时间:— · 模型级成功率/延迟/吞吐:暂无数据