–可用模型
–上游状态
–近 24 小时请求
–成功率
OpenAI 协议
/v1/chat/completions、/v1/responses、/v1/images/generations,现有代码改个地址就能用。
推理档位
模型名后加括号选择思考强度,如 gpt-5.6-terra(high)、gemini-3.8-flash(minimal)。
流式输出
"stream": true 逐字返回,服务器全程不缓冲。
不存对话
只记录模型、耗时、Token 数等统计,不保存任何请求与回复内容。
快速开始
模型广场
点击模型名即可复制。带档位的模型可在名字后加 (档位)。
选择模型,输入消息开始体验。
Enter 发送,Shift+Enter 换行
Enter 发送,Shift+Enter 换行
接入文档
基本信息
| Base URL | |
|---|---|
| API Key | |
| 限额 |
接口
| GET | /v1/models | 模型列表(含所有档位写法) |
|---|---|---|
| POST | /v1/chat/completions | 对话,支持 stream、图片输入 |
| POST | /v1/responses | Responses API(Codex CLI 等) |
| POST | /v1/images/generations | 文生图,返回 b64_json |
代码示例
推理档位
在模型名后加括号:gpt-5.6-terra(high)。不加括号用模型默认档位。各模型可用档位见模型广场。
GPT 系列:low / medium / high / xhigh;Gemini Flash:minimal / low / medium / high。
错误码
| 400 | 请求格式错误,或模型不在可用列表(model_not_found) |
|---|---|
| 401 | 开启门禁后 Key 无效 |
| 429 | 触发限速或当日额度用完 |
| 502 | 上游暂时不可用,稍后重试 |
服务状态
–上游
–近 24 小时请求
–近 24 小时 Token
–今日全站额度
近 24 小时请求量
成功 失败