GGPU API 快速接入
用一套固定网关和访问凭证完成首次调用,并建立后续接入都能复用的请求结构。
统一 Base URL: https://api.ggpu.ai。它不包含额外的 /api 后缀;调用时直接在其后拼接 /v1/... 接口路径。
接入前准备
先确认这三项,再排查请求参数。这样可以把“连接不到网关”“鉴权失败”和“模型不可用”分开处理。
一次请求由什么组成
接入配置地址与凭证Base URL、API Key 与模型名称
HTTP 请求方法、路径与 JSON请求头负责鉴权,请求体描述任务
调用结果状态、内容与用量先判断状态,再读取业务字段
- 统一地址
- 固定网关拼接接口路径
- Bearer 鉴权
- 密钥仅保存在服务端
- JSON 数据
- 按能力组织请求参数
- 请求标识
- 保留 ID 便于定位问题
完成第一条请求
配置环境变量
export BASE_API_URI="https://api.ggpu.ai"
export GGPU_ACCESS_CREDENTIAL_SECRET="<access-credential-secret>"把完整密钥保存在服务端环境变量或密钥管理工具中。不要提交到代码仓库,也不要放进浏览器端代码。
发送最小文本请求
curl -X POST "${BASE_API_URI}/v1/chat/completions" \
-H 'Content-Type: application/json' \
-H "Authorization: Bearer ${GGPU_ACCESS_CREDENTIAL_SECRET}" \
-H 'X-Request-Id: quickstart-001' \
-d '{
"model": "<model-name>",
"messages": [
{
"role": "user",
"content": "请用一句话介绍GGPU API。"
}
]
}'将 <model-name> 替换为当前账号可用的模型 ID。完整请求地址是:
https://api.ggpu.ai/v1/chat/completions判断调用是否成功
先检查 HTTP 状态码,再确认响应体中存在可读取的结果字段。文本对话的典型成功响应会包含 choices:
{
"id": "chatcmpl_xxx",
"choices": [
{
"message": {
"role": "assistant",
"content": "GGPU API 提供统一的模型调用入口。"
},
"finish_reason": "stop"
}
]
}如果返回非 2xx 状态,不要只重复发送请求。保留状态码、响应体、请求时间和 X-Request-Id,再按 错误处理 分流。
通用请求约定
每个 JSON 请求至少包含以下请求头:
Content-Type: application/json
Authorization: Bearer <access-credential-secret>需要追踪调用来源时,可以增加: