-本站完全兼容 OpenAI 协议,把官方 SDK 的 base_url 换成上面的地址即可。
-模型名以 GET /v1/models 返回为准。
加载中…
加载中…
服务端为逐块转发,不做缓冲;响应头带 X-Queue-Position 与 X-Queue-Wait-Ms。
max_concurrency 个请求真正打到上游。: queued position=N 形式的 SSE 注释行,用于保活。queue_full(429) 与 queue_timeout(503)。| HTTP | code | 说明 | 处理建议 |
|---|---|---|---|
| 401 | missing_api_key / invalid_api_key / token_disabled / user_disabled | 密钥缺失、无效、令牌或账户被禁用 | 检查 Authorization 头与令牌状态 |
| 402 | insufficient_balance | 余额不足 | 充值后自动恢复 |
| 404 | model_not_found | 模型不存在 | 通过 GET /v1/models 查询 |
| 413 | payload_too_large | 请求体超过 1MB | 精简请求体 |
| 429 | queue_full | 服务繁忙,排队已满 | 退避后重试 |
| 503 | queue_timeout | 排队超时 | 稍后重试 |
| 504 | upstream_timeout | 上游连接/读取超时 | 稍后重试 |
| 5xx | upstream_error | 上游服务异常(原样透传) | 按上游错误处理 |
错误响应统一为 OpenAI 格式:{"error":{"message":"...","type":"...","code":"..."}}