更新日志
记录客户端能感知到的变化——新增/调整的错误码、判定口径的变更、协议兼容性的扩展。 纯内部实现的改动不在这里。
兼容性承诺
错误码 code 是稳定契约,只增不改语义;
message 是给人看的,措辞可能调整——
所以程序里请判 code,不要匹配 message 字符串。
2026-08-24
-
变更
错误码
40005停用,输出长度/思考预算不再由网关判定。 此前thinking.budget_tokens达到或超过平台记录的模型输出上限时,网关会在入口直接拒绝; 现在不再拦截,请求照常转发,由上游厂商裁定,其原始错误经upstream_body原样带回。
背景:模型的输出上限是厂商侧的事实,平台库里只是一份手工维护、必然滞后的副本。 判对时是冗余(上游会给出同样且更权威的答复),判错时则凭空制造一个上游根本不会产生的失败。
影响:此前被40005拦下的请求现在会真的发到上游——参数确实越界的, 拿到的是厂商的 400;参数其实没越界、只是平台配置偏低的,现在能正常跑通。40005的号段保留不复用,客户端已有的判断分支可以留着,只是不会再命中。 见 错误码总表。
2026-08-18
- 新增 API 文档站上线。首版覆盖快速开始、五个协议端点的接口参考、 鉴权/流式/错误/限流/计费/模型六篇指南,以及错误码总表与常见问题。
2026-08-17
-
变更
模型准入的认证等级判定归一。认证等级现在只取自账号资料中的用户类型,
与用户中心页面显示、模型列表下发使用同一份数据。
影响:此前可能出现「页面已显示企业认证、调用却被40203拦下」的不一致, 现已消除。后台修改用户类型后立即生效。见 模型、准入与回退。 -
变更
上游限流导致的失败也会触发模型回退。
链路层的限流计数是按模型维度记的,换一个模型确实可能还有额度,因此不再把限流排除在回退条件之外。
影响:配置了回退模型时,被限流的请求可能由回退模型静默完成。 对模型有强要求的场景请校验响应中的模型名。
2026-08-15
-
新增
错误码
50234policy not found or disabled。 凭证的限制策略缺失或被禁用时返回。
背景:此前该场景复用50233proxy not found, 日志里报「找不到代理」会把排查引向完全错误的方向——即使凭证根本没配代理。 拆成独立错误码后,故障定位不再需要猜。见 错误码总表。
更早
以下变更早于本文档站上线,未逐条记录日期,一并列在这里:
-
新增
错误码
42908all upstreams temporarily rate-limited, please retry later—— 所有上游都在限流/失败冷却中的临时态,带Retry-After。 与「没有可用上游配置」的50201区分开:前者等等就好,后者等多久都不会好。 -
新增
错误码
40005——要求的输出长度(含思考预算)超过模型输出上限时, 在入口一次判定,不进厂商循环、不发上游、不计费。 该条 message 直接下发中文,因为终端用户自己可以处理。 -
新增
OpenAI Responses 协议端点
POST /v1/responses, 支持 Codex CLI / Codex Desktop 直接接入。见 Responses API。 -
新增
Gemini 原生协议端点
POST /v1beta/models/{model}:generateContent。 注意:当前公网边缘尚未放行/v1beta前缀, 调 Gemini 系模型请暂用/v1/chat/completions,网关会自动转换。 见 Gemini 原生接口。 -
新增
图片端点
/v1/images/generations与/v1/images/edits,JSON 与multipart/form-data两种请求体都支持。 -
变更
请求体上限提升至 100 MiB(
41301), 以容纳图片编辑类请求。 - 变更 并发槽位自愈机制。槽位带时间戳,存活超过 600 秒会被下一次入口校验自动剔除, 进程异常退出导致的槽位泄漏最多 10 分钟自愈,无需人工清理。
关于版本号
APIGOTO 的兼容端点没有独立的 API 版本号——路径里的 /v1
是为了与各厂商 SDK 的默认拼接规则对齐,不代表平台自己的版本。
兼容性的边界由上面的承诺定义:错误码只增不改,请求/响应结构保持向后兼容。
发现文档与实际行为不符时,以实际行为为准并请反馈—— 那多半是文档没跟上,我们会修。