大模型 API 反代

通用大模型 API 中转 · 路径即目标地址 · 原生支持流式 SSE · 按厂商适配错误体

检测中

构造代理地址

把任意大模型 API 地址拼在本站域名后面即可。下面按厂商选一个起点,再改成你要的端点。

SDK 的 base_url 填到版本段即可,例如 。 路径中的 // 会被 HTTP 运行层合并为 /,因此本站统一输出单斜杠写法,省掉一次跳转。

调用示例

把地址换成上面的代理地址即可,其余参数与官方接口完全一致。

# 非流式
curl  \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model":"gpt-4o-mini","messages":[{"role":"user","content":"你好"}]}'

# 流式(SSE)—— 首包直出,不缓冲
curl -N  \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model":"gpt-4o-mini","stream":true,"messages":[{"role":"user","content":"你好"}]}'

为大模型场景做的定向优化

厂商自动识别按目标域名认出 OpenAI / Anthropic / Gemini / DeepSeek 等二十家,诊断头 x-proxy-provider 直接给出结果
错误体按厂商适配Anthropic 与 Gemini 的 SDK 读的错误结构跟 OpenAI 不同,代理层的报错按目标厂商返回对应格式,SDK 能正常解析
SSE 首包不缓冲流式响应加 no-cache, no-transform 与 x-accel-buffering: no,禁止中间层压缩——压缩是首 token 延迟的元凶
凭证零干预Authorization / x-api-key / x-goog-api-key / anthropic-version / OpenAI-Beta 等原样上送,不改写不占用
查询参数直通Gemini 用 ?key= 传密钥、各家用的 ?alt= / ?version= 一律原样转发;路径里的 url 参数不会再被误当成目标
重定向改写上游 30x 的 Location 自动改回本站单斜杠路径,客户端跟随仍走反代,不会直连上游暴露真实地址
超时可调默认 55s 上游首字节超时,UPSTREAM_TIMEOUT_MS 可调;响应体一旦开始传输就不再受该超时限制
安全闸门默认拒绝内网 / 回环 / 云元数据目标(403 且不回源),覆盖 IPv6 映射与整型写法;需要时开 ALLOW_PRIVATE_TARGETS
免认证不设访问口令,客户端只填 base_url + 自己的上游 Key,与直连一致

连通性自测

从你的浏览器经本站访问各厂商接口,验证链路是否通畅(401 / 403 表示已成功到达上游,仅缺密钥)。

OpenAIapi.openai.com/v1/models
待测
Anthropicapi.anthropic.com/v1/models
待测
DeepSeekapi.deepseek.com/v1/models
待测
Google Geminigenerativelanguage.googleapis.com/v1beta/models
待测
OpenRouteropenrouter.ai/api/v1/models
待测
参照 · GitHubapi.github.com/zen
待测