https://api.csz.asia/v1https://gdlr.asia/v1Authorization: Bearer sk-…x-api-key | x-goog-api-keyapplication/json密钥在控制台创建,绑定分组(决定可用模型与倍率),可随时吊销重建。
| 方法 | 路径 | 说明 |
|---|---|---|
| POST | /v1/chat/completions | 对话补全(最常用) |
| POST | /v1/responses | Responses 协议(Codex 类客户端) |
| GET | /v1/models | 当前密钥可见的模型列表 |
| POST | /chat/completions | 上表的简写路径(等价) |
| POST | /responses | 上表的简写路径(等价) |
POST /v1/chat/completions
{
"model": "deepseek-v4-flash-0731",
"messages": [
{"role": "system", "content": "你是运维助手"},
{"role": "user", "content": "写一个 Nginx 限流配置"}
],
"stream": true,
"max_tokens": 1024,
"temperature": 0.7
}
| 字段 | 类型 | 说明 |
|---|---|---|
model | string | 必填;须为当前密钥分组可见的模型 |
messages | array | 必填;system/user/assistant/tool 角色序列 |
stream | bool | 是否 SSE 流式返回,长文本建议开启 |
max_tokens | int | 输出上限;推理型模型未设置时按网关默认预算执行 |
temperature | float | 采样温度 |
tools | array | 函数调用定义,按分组支持 |
data: {"id":"chatcmpl-…","object":"chat.completion.chunk","choices":[{"delta":{"content":"你"}}]}
data: {"id":"chatcmpl-…","object":"chat.completion.chunk","choices":[{"delta":{"content":"好"}}]}
data: [DONE]
每行以 data: 开头,最后一行 data: [DONE] 结束;断流请按指数退避重试。
POST /v1/responses
{
"model": "gpt-5.6",
"input": "把这段日志按错误类型归类",
"instructions": "输出 Markdown 表格",
"max_output_tokens": 2048,
"stream": false
}
返回体为 object: "response",正文在
output[].content[].text,用量在 usage。
| 字段 | 类型 | 说明 |
|---|---|---|
model | string | 必填 |
input | string / array | 必填;纯文本或消息数组 |
instructions | string | 系统级指令(等价 system) |
max_output_tokens | int | 输出上限;未设置时网关补默认预算,避免长会话被截断 |
stream | bool | 流式事件流 |
Codex 等客户端只需把 base_url 指向
https://api.csz.asia/v1,其余配置保持默认。
ERRORS · RATE LIMIT
| HTTP | code | 含义与处理 |
|---|---|---|
| 400 | invalid_request_error | 参数或模型不合法;检查 model 是否在当前分组内 |
| 401 | API_KEY_REQUIRED / UNAUTHORIZED | 未带密钥或密钥失效;重新生成密钥 |
| 403 | FORBIDDEN | 密钥无该分组权限,或分组被停用 |
| 404 | NOT_FOUND | 路径写错(注意 base_url 已含 /v1,不要再拼一次) |
| 429 | RATE_LIMITED | 并发或频率超限;退避重试或申请提额 |
| 502 / 503 | UPSTREAM_ERROR | 上游瞬时不可用;指数退避重试,持续出现请联系我们 |
| 504 | UPSTREAM_TIMEOUT | 长上下文或上游拥堵;缩短上下文后重试 |
MODELS · BILLING
| 分组(密钥维度) | 代表模型 | 倍率口径 | 典型场景 |
|---|---|---|---|
| 按量 · 经济档 | deepseek-v4-flash、glm-5.3-flash | 约 0.05×–0.2× 官方价 | 批量任务、长文本处理 |
| 按量 · 标准档 | glm-5.3、deepseek-v4-pro | 约 0.2×–0.5× 官方价 | 常规业务对话与代码生成 |
| 按量 · 高配档 | gpt-5.6(Responses) | 按分组倍率 | 复杂推理、智能体、Codex 类客户端 |
| 日卡 / 月卡 | 主流模型全开(按分组) | 限时权益,不按倍率累计 | 短周期高强度开发 |
| 企业专属 | 指定模型与上游 | 合同约定 | 合规、隔离、SLA 要求 |
计费口径:扣费 ≈ 官方价 × token 用量 × 分组倍率,额度按 1 元 = 1 美元入账;
每次调用的用量与扣费都能在控制台"用量记录"里逐笔对上。
SDK · CLI
from openai import OpenAI
client = OpenAI(api_key="sk-…", base_url="https://api.csz.asia/v1")
r = client.chat.completions.create(
model="glm-5.3",
messages=[{"role": "user", "content": "你好"}],
stream=True,
)
for chunk in r:
print(chunk.choices[0].delta.content or "", end="")
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.CSZ_API_KEY,
baseURL: "https://api.csz.asia/v1",
});
const r = await client.chat.completions.create({
model: "deepseek-v4-flash-0731",
messages: [{ role: "user", content: "你好" }],
});
console.log(r.choices[0].message.content);
curl -s https://api.csz.asia/v1/chat/completions \
-H "Authorization: Bearer $CSZ_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.3","messages":[{"role":"user","content":"ping"}],"max_tokens":16}'
401=密钥问题 · 200=链路正常 · 5xx=我们的问题(把时间点发我们)
[model_providers.csz] name = "成作聚合" base_url = "https://api.csz.asia/v1" wire_api = "responses" env_key = "CSZ_API_KEY"
写入客户端配置后,直接选模型即可;Responses 路径网关已做长会话兜底。