OpenAI · 棉花糖 API 路由
gpt-5.6-sol
最强档 · 复杂推理与长上下文
标准倍率读取中正在读取网关1M+ ctx128K out模型级样本:暂无
GATEWAY HEARTBEAT · 全局读取中
OpenAI 兼容流式输出会话保持自动故障转移
目录已配置不等于当前模型一定可调度。当前后端只提供全局网关状态,尚未提供按模型拆分的成功率、延迟与吞吐;因此本页不会把全局状态伪装成模型健康度。
Pricing
定价
单位为每百万 Token(USD)。现价按标准线路折扣计算,原价作为对照。
输入—原价 — / 1M
输出—原价 — / 1M
缓存写入—/ 1M tokens
缓存读取—/ 1M tokens
Access capabilities
接入能力
以下是棉花糖 API 网关层提供的接入能力,不冒充上游模型官方能力清单。
Protocol
支持协议
使用 OpenAI 兼容格式。只改 base_url,其余 SDK 调用方式保持不变。
Chat Completions APIOpenAI 兼容格式展开接入参数
Base URL
https://api.mallowapi.com/v1Endpoint
POST /chat/completionsModel
gpt-5.6-solcurl https://api.mallowapi.com/v1/chat/completions \
-H "Authorization: Bearer $SUB2API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-sol",
"messages": [{"role": "user", "content": "Hello"}],
"stream": true
}'Context & limits
上下文与限制
以下为上游官方 API 公布的规格,作为参考;经棉花糖 API 账号池中转后的实际限制以控制台与实时调用为准。
上下文窗口1M+
最大输出 Token128K
规格来源官方规格参考
可用线路标准倍率读取中
OpenAI 官方 API 规格(上下文 1,050,000 tokens · 输出 128,000 tokens),非棉花糖 API 实测承诺;超长上下文的实际可用性以账号池当日调度为准。
Gateway status
状态信息
下列数据直接来自 /api/status。它描述全局网关,不是该模型的独立 SLA。
全局网关读取中
健康账号—
全局延迟—
30 天可用率—
——0 ms
正在采样…
100%50%0%
正在采样…
趋势图为本页浏览器向 /api/status 的实测探测(往返延迟与可达性),反映你当前到网关的连通性;不是模型级 SLA,也不代表推理耗时。
更新时间:— · 模型级成功率/延迟/吞吐:暂无数据