错误处理
先判断错误属于地址、鉴权、参数、资源、额度还是临时服务异常,再决定修正配置、降低请求或有限重试。
排障日志可以记录请求时间、请求 ID、模型和状态码,但不要记录完整 API Key;业务输入和模型输出也应按数据安全要求脱敏。
推荐排查顺序
保留原始错误上下文
记录请求时间、HTTP 状态码、响应体和 X-Request-Id。没有这些信息时,后续很难把客户端日志与平台记录对应起来。
检查地址与路径
Base URL 应为 https://api.ggpu.ai,其后直接拼接 /v1/...。确认没有重复 /api、路径拼写错误或多余空格。
检查鉴权
确认 Authorization 使用 Bearer <secret>,Key 完整、状态可用且没有混用其他环境的凭证。
检查模型与参数
模型名称来自当前可用列表,请求 JSON 可以解析,必填字段存在,可选参数也确实受该模型支持。
检查额度与请求节奏
额度不足时先处理账户或 Key 配置;触发限流时降低并发并使用有上限的退避重试。
最后处理临时服务异常
只对适合重试的请求处理临时 5xx。达到重试上限后保留上下文并结束,避免形成持续请求风暴。
常见 HTTP 状态码
不要依赖单一错误结构
最简错误可能只有一个字段:
{
"error": "unauthorized"
}实际错误体可能提供更多信息。客户端应先保留原始响应,再安全读取已知字段;不要让“解析错误消息失败”覆盖真正的 HTTP 错误。