轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥8起我的订单
文档
工具
提交工单页面收录
ghcr.io/tbphp/gpt-load

ghcr.io/tbphp/gpt-load:beta

ghcr.iolinux/amd64beta大小: 14.55 MB更新于 2026年8月23日
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这句话即可:

请先完整阅读并严格遵守以下文档中的全部规则与要求:

https://xuanyuan.cloud/agents.md

在未充分阅读并理解该文档前,不要生成任何命令、配置、修改建议、故障排查方案或技术回答。后续所有输出都必须严格以该文档中的规范为最高优先级执行。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

GPT-Load

English | 中文 | 日本語

一款高性能、企业级的AI API透明代理服务,专为需要集成多个AI服务的企业和开发者设计。使用Go构建,具备智能密钥管理、负载均衡和全面监控能力,适用于高并发生产环境。

详细文档请访问 官方文档

赞助商

感谢APIMart对本项目的赞助!APIMart是一个低成本的AI图像和视频生成API平台——GPT-Image-2低至$0.006/张,每***可生成160+张图像。一个异步API同时覆盖图像和视频:提交任务,获取ID,通过轮询或回调获取结果。可批量处理数万张图像而无超时,无需更改代码即可切换模型。按使用付费,无月费——立即注册开始使用。

非常感谢LINUX DO社区的支持!

本项目由DigitalOcean支持。

特性

  • 透明代理:完全保留原生API格式,支持OpenAI、Google Gemini、Anthropic Claude等多种格式
  • 智能密钥管理:高性能密钥池,支持分组管理、自动轮换和故障恢复
  • 负载均衡:多上游端点加权负载均衡,提升服务可用性
  • 智能故障处理:自动密钥黑名单管理和恢复机制,确保服务连续性
  • 动态配置:系统设置和分组配置支持热重载,无需重启
  • 企业级架构:分布式主从部署,支持水平扩展和高可用
  • 现代化管理:基于Vue 3的Web管理界面,直观易用
  • 全面监控:实时统计、健康检查和详细请求日志
  • 高性能设计:零拷贝流处理、连接池复用和原子操作
  • 生产就绪:优雅关闭、错误恢复和全面安全机制
  • 双重认证:管理端和代理端分离认证,代理认证支持全局和分组级密钥

支持的AI服务

GPT-Load作为透明代理服务,完全保留各AI服务提供商的原生API格式:

  • OpenAI格式:官方OpenAI API、Azure OpenAI及其他OpenAI兼容服务
  • Google Gemini格式:Gemini Pro、Gemini Pro Vision等模型的原生API
  • Anthropic Claude格式:Claude系列模型,支持高质量对话和文本生成
设置项环境变量默认值描述
服务端口PORT3001HTTP服务器监听端口
服务地址HOST0.0.0.0HTTP服务器绑定地址
读取超时SERVER_READ_TIMEOUT60HTTP服务器读取超时(秒)
写入超时SERVER_WRITE_TIMEOUT600HTTP服务器写入超时(秒)
空闲超时SERVER_IDLE_TIMEOUT120HTTP连接空闲超时(秒)
优雅关闭超时SERVER_GRACEFUL_SHUTDOWN_TIMEOUT10服务优雅关闭等待时间(秒)
从节点模式IS_SLAVEfalse集群部署中的从节点标识
时区TZAsia/Shanghai指定时区

安全配置:

设置项环境变量默认值描述
管理密钥AUTH_KEY-管理端的访问认证密钥,请更换为强密码
加密密钥ENCRYPTION_KEY-加密静态存储的API密钥。支持任意字符串,留空则禁用加密。详见数据加密迁移

数据库配置:

设置项环境变量默认值描述
数据库连接DATABASE_DSN./data/gpt-load.db数据库连接字符串(DSN)或文件路径
Redis连接REDIS_DSN-Redis连接字符串,留空时使用内存存储

性能与CORS配置:

设置项环境变量默认值描述
最大并发请求数MAX_CONCURRENT_REQUESTS100系统允许的最大并发请求数
启用CORSENABLE_CORSfalse是否启用跨域资源共享
允许的源ALLOWED_ORIGINS-允许的源,逗号分隔
允许的方法ALLOWED_METHODSGET,POST,PUT,DELETE,OPTIONS允许的HTTP方法
允许的请求头ALLOWED_HEADERS*允许的请求头,逗号分隔
允许凭据ALLOW_CREDENTIALSfalse是否允许发送凭据

日志配置:

设置项环境变量默认值描述
日志级别LOG_LEVELinfo日志级别:debug、info、warn、error
日志格式LOG_FORMATtext日志格式:text、json
启用文件日志LOG_ENABLE_FILEfalse是否启用文件日志输出
日志文件路径LOG_FILE_PATH./data/logs/app.log日志文件存储路径

代理配置:

GPT-Load会自动从环境变量读取代理设置,用于向上游AI服务提供商发起请求。

设置项环境变量默认值描述
HTTP代理HTTP_PROXY-HTTP请求的代理服务器地址
HTTPS代理HTTPS_PROXY-HTTPS请求的代理服务器地址
不使用代理NO_PROXY-绕过代理的主机或域名列表,逗号分隔

支持的代理协议格式:

  • HTTP:http://user:pass@host:port
  • HTTPS:https://user:pass@host:port
  • SOCKS5:socks5://user:pass@host:port

动态配置(热重载)

基本设置:

设置项字段名默认值分组覆盖描述
项目URLapp_urlhttp://localhost:3001❌项目基础URL
全局代理密钥proxy_keys初始值来自AUTH_KEY❌全局生效的代理密钥,逗号分隔
日志保留天数request_log_retention_days7❌请求日志保留天数,0表示不清理
日志写入间隔request_log_write_interval_minutes1❌日志写入数据库周期(分钟)
启用请求体日志enable_request_body_loggingfalse✅是否在请求日志中记录完整请求体内容

请求设置:

设置项字段名默认值分组覆盖描述
请求超时request_timeout600✅转发请求完整生命周期超时(秒)
连接超时connect_timeout15✅与上游服务建立连接的超时时间(秒)
空闲连接超时idle_conn_timeout120✅HTTP客户端空闲连接超时(秒)
响应头超时response_header_timeout600✅等待上游响应头的超时时间(秒)
最大空闲连接数max_idle_conns100✅连接池最大总空闲连接数
每主机最大空闲连接数max_idle_conns_per_host50✅每个上游主机的最大空闲连接数
代理URLproxy_url-✅转发请求的HTTP/HTTPS代理,留空则使用环境变量

密钥配置:

设置项字段名默认值分组覆盖描述
最大重试次数max_retries3✅单个请求使用不同密钥的最大重试次数
黑名单阈值blacklist_threshold3✅密钥累计失败多少次后被加入黑名单
密钥验证间隔key_validation_interval_minutes60✅后台定时密钥验证周期(分钟)
密钥验证并发数key_validation_concurrency10✅后台验证无效密钥的并发数
密钥验证超时key_validation_timeout_seconds20✅后台验证单个密钥的API请求超时(秒)

数据加密迁移

GPT-Load支持API密钥的加密存储。您可以随时启用、禁用或更改加密密钥。

查看数据加密迁移详情

迁移场景

API使用指南

代理接口调用

GPT-Load通过组名将请求路由到不同的AI服务。使用方法如下:

1. 代理端点格式

  • {group_name}:在管理界面中创建的组名
  • {original_api_path}:与原始AI服务路径保持完全一致

2. 认证方式

在Web管理界面中配置代理密钥,支持系统级和组级代理密钥。

  • 认证方式:与原生API一致,但将原始密钥替换为配置的代理密钥。
  • 密钥作用域:在系统设置中配置的全局代理密钥可用于所有组。在组中配置的组代理密钥仅对当前组有效。
  • 格式:多个密钥用逗号分隔。

3. OpenAI接口示例

GPT-Load目前支持两种OpenAI兼容的组类型:

  • openai(OpenAI Chat Completions格式)
  • openai-response(OpenAI Responses格式)

假设已创建名为openai的组:

原始调用:

curl -X POST https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-openai-key" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-4.1-mini", "messages": [{"role": "user", "content": "Hello"}]}'

代理调用:

curl -X POST http://localhost:3001/proxy/openai/v1/chat/completions \
-H "Authorization: Bearer your-proxy-key" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-4.1-mini", "messages": [{"role": "user", "content": "Hello"}]}'

需修改内容:

  • 将https://api.openai.com替换为http://localhost:3001/proxy/openai
  • 将原始API密钥替换为代理密钥

OpenAI Responses格式示例(openai-response组):

curl -X POST http://localhost:3001/proxy/openai-response/v1/responses \
-H "Authorization: Bearer your-proxy-key" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-4.1-mini", "input": "Hello"}'

4. Gemini接口示例

假设已创建名为gemini的组:

原始调用:

curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.5-pro:generateContent?key=your-gemini-key \
-H "Content-Type: application/json" \
-d '{"contents": [{"parts": [{"text": "Hello"}]}]}'

代理调用:

curl -X POST http://localhost:3001/proxy/gemini/v1beta/models/gemini-2.5-pro:generateContent?key=your-proxy-key \
-H "Content-Type: application/json" \
-d '{"contents": [{"parts": [{"text": "Hello"}]}]}'

需修改内容:

  • 将https://generativelanguage.googleapis.com替换为http://localhost:3001/proxy/gemini
  • 将URL参数中的key=your-gemini-key替换为代理密钥

5. Anthropic接口示例

假设已创建名为anthropic的组:

原始调用:

curl -X POST https://api.anthropic.com/v1/messages \
-H "x-api-key: sk-ant-api03-your-anthropic-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model": "claude-sonnet-4-20250514", "messages": [{"role": "user", "content": "Hello"}]}'

代理调用:

curl -X POST http://localhost:3001/proxy/anthropic/v1/messages \
-H "x-api-key: your-proxy-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model": "claude-sonnet-4-20250514", "messages": [{"role": "user", "content": "Hello"}]}'

需修改内容:

  • 将https://api.anthropic.com替换为http://localhost:3001/proxy/anthropic
  • 将x-api-key请求头中的原始API密钥替换为代理密钥

6. 支持的接口

OpenAI 聊天补全格式(openai):

  • /v1/chat/completions - 聊天对话
  • /v1/completions - 文本补全
  • /v1/embeddings - 文本嵌入
  • /v1/models - 模型列表
  • 以及所有其他 OpenAI 兼容接口

OpenAI 响应格式(openai-response):

  • /v1/responses - 统一响应生成
  • /v1/models - 模型列表
  • 以及所有其他 OpenAI Responses 兼容接口

Gemini 格式:

  • /v1beta/models/*/generateContent - 内容生成
  • /v1beta/models - 模型列表
  • 以及所有其他 Gemini 原生接口

Anthropic 格式:

  • /v1/messages - 消息对话
  • /v1/models - 模型列表(若可用)
  • 以及所有其他 Anthropic 原生接口

7. 客户端 SDK 配置

OpenAI Python SDK:

from openai import OpenAI

client = OpenAI(
api_key="your-proxy-key", # 使用代理密钥
base_url="http://localhost:3001/proxy/openai" # 使用代理端点
)

response = client.chat.completions.create(
model="gpt-4.1-mini",
messages=[{"role": "user", "content": "Hello"}]
)

Google Gemini SDK(Python):

import google.generativeai as genai

# 配置 API 密钥和基础 URL
genai.configure(
api_key="your-proxy-key", # 使用代理密钥
client_options={"api_endpoint": "http://localhost:3001/proxy/gemini"}
)

model = genai.GenerativeModel('gemini-2.5-pro')
response = model.generate_content("Hello")

Anthropic SDK(Python):

from anthropic import Anthropic

client = Anthropic(
api_key="your-proxy-key", # 使用代理密钥
base_url="http://localhost:3001/proxy/anthropic" # 使用代理端点
)

response = client.messages.create(
model="claude-sonnet-4-20250514",
messages=[{"role": "user", "content": "Hello"}]
)

[!IMPORTANT] 作为透明代理服务,GPT-Load 完全保留了各类 AI 服务的原生 API 格式和认证方式。您只需替换端点地址,并使用管理界面中配置的 代理密钥 即可实现无缝迁移。

相关项目

  • https://github.com/QuantumNous/new-api - 优秀的 AI 模型聚合管理与分发系统

贡献

感谢所有为 GPT-Load 做出贡献的开发者!

许可证

MIT 许可证 - 详情参见 LICENSE 文件。

星标历史

轩辕镜像配置手册

按平台快速找到配置文档

一键安装

一键安装 Docker

Linux Docker 一键安装

AI

用 AI 使用轩辕镜像

agents.md · AI 对话 · 提示词

Docker

登录仓库拉取

登录认证 · 私有仓库

专属域名拉取

免登录 · 高速拉取

Linux

Docker 镜像配置

Windows / Mac

Docker Desktop 配置

MacOS OrbStack

OrbStack 容器

Apple Container

macOS 原生容器

Docker Compose

Compose 项目配置

NAS

群晖

Synology 配置

飞牛

fnOS 镜像配置

绿联

绿联 NAS

威联通

QNAP 配置

极空间

极空间 NAS

Unraid

Unraid NAS

企业仓库

其他仓库

ghcr · Quay · nvcr

Harbor 镜像源

Proxy Repository 对接

Portainer 镜像源

Registries 配置

Nexus 镜像源

Docker Proxy 缓存

开发工具

Dev Containers

VS Code 开发容器

Podman

Podman 配置指南

Singularity / Apptainer

HPC 科学计算容器

Kubernetes

K8s Containerd

Kubernetes · Containerd

K3s

轻量级集群

面板 / 网络

爱快路由

爱快 4.0 · iKuai 镜像加速

宝塔面板

一键配置镜像源

需要其他帮助?请查看我们的 常见问题Docker 镜像访问常见问题解答 或 提交工单

镜像拉取常见问题

功能

版本功能对比

功能对比 · 版本选择

支持的镜像仓库

Docker Hub · GCR · GHCR

专属域名用法

专属域名 · 开启停用 · 多仓库

新手拉取配置

登录 · 专属域名 · 配置

docker search 限制

专属域名 · Hub 搜索

不支持 push

仅支持 pull · 不支持

拉取速度原因

带宽 · 缓存 · 冷热镜像

错误码

402 与流量用尽

402 · 流量包 · 充值

401 认证失败

401 · docker login

manifest unknown

标签错误 · 镜像不存在

410 Gone 排查

410 · Docker 升级

429 限流

免费版 · 专业版 · 企业版 · 请求频率

其他报错

DNS 超时

DNS 解析 · 网络超时

TLS 证书失败

no matching manifest(架构)

docker.sock / daemon

账号

失败是否计费

manifest · blob · 计费

申请开票(企业 / 个人)

开票 · 发票 · 工单

修改登录密码

网站 · 仓库 · 重置

注销账户

工单 · 数据 · 注销

原理

mirrors 不生效

daemon.json · 重启

去掉域名前缀

docker tag · 重命名

指定架构拉取

ARM64 · AMD64 · 多架构

latest 与「最新」

digest · 版本号 · 标签

查看全部问题→

用户好评

来自真实用户的反馈,见证轩辕镜像的优质服务

用户头像

oldzhang

运维工程师

Linux服务器

5

"Docker访问体验非常流畅,大镜像也能快速完成下载。"

轩辕镜像
镜像详情
...
ghcr.io/tbphp/gpt-load
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥8/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥8/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱