← 返回模型目录
xAI · 棉花糖 API 路由

grok-4.5

编码强档 · 500K 上下文

标准倍率读取中正在读取网关500K ctx模型级样本:暂无
GATEWAY HEARTBEAT · 全局读取中
OpenAI 兼容流式输出会话保持自动故障转移

目录已配置不等于当前模型一定可调度。当前后端只提供全局网关状态,尚未提供按模型拆分的成功率、延迟与吞吐;因此本页不会把全局状态伪装成模型健康度。

Pricing

定价

单位为每百万 Token(USD)。现价按标准线路折扣计算,原价作为对照。

输入原价 — / 1M
输出原价 — / 1M
缓存写入/ 1M tokens
缓存读取/ 1M tokens

Access capabilities

接入能力

以下是棉花糖 API 网关层提供的接入能力,不冒充上游模型官方能力清单。

Protocol

支持协议

使用 OpenAI 兼容格式。只改 base_url,其余 SDK 调用方式保持不变。

Chat Completions APIOpenAI 兼容格式展开接入参数
Base URLhttps://api.mallowapi.com/v1
EndpointPOST /chat/completions
Modelgrok-4.5
curl https://api.mallowapi.com/v1/chat/completions \
  -H "Authorization: Bearer $SUB2API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [{"role": "user", "content": "Hello"}],
    "stream": true
  }'

Context & limits

上下文与限制

以下为上游官方 API 公布的规格,作为参考;经棉花糖 API 账号池中转后的实际限制以控制台与实时调用为准。

上下文窗口500K
最大输出 Token未公布
规格来源官方规格参考
可用线路标准倍率读取中

xAI 官方 API 规格(上下文 500,000 tokens · 输出 未公布),非棉花糖 API 实测承诺;超长上下文的实际可用性以账号池当日调度为准。

Gateway status

状态信息

下列数据直接来自 /api/status。它描述全局网关,不是该模型的独立 SLA。

全局网关读取中
健康账号
全局延迟
30 天可用率
到网关延迟趋势本页实测 · 每 6 秒
0 ms

正在采样…

探测成功率本页实测 · 滚动窗口
100%50%0%

正在采样…

趋势图为本页浏览器向 /api/status 的实测探测(往返延迟与可达性),反映你当前到网关的连通性;不是模型级 SLA,也不代表推理耗时。

更新时间:— · 模型级成功率/延迟/吞吐:暂无数据

← 返回模型目录