如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。
只需在 AI 对话中先发送下面这段话即可:
请先阅读并遵守:https://xuanyuan.cloud/agents.md
未读文档前不要生成 pull 命令或排错方案。查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。
一个用于多渠道、多凭证设置的自托管AI网关
API密钥、订阅账户、流量调度、故障处理、请求日志和使用统计——均通过单一入口点管理。
English · 中文 · 日本語 | Official Website
成为赞助商
赞助商详情(可折叠)
OfoxAI:集文本、图像和视频AI于一体的平台 OfoxAI是一个统一的AI API平台,汇集了来自多个提供商的文本、图像和视频模型。通过兼容OpenAI的端点以及原生Anthropic和Gemini接口,开发人员可以通过一个平台访问用于AI应用、智能体和内容创作的模型。探索OfoxAI模型和API →
保护和加速网站与API,服务中国大陆及全球用户,并通过客户端SDK将加速和安全能力扩展到原生/移动应用——自建私有部署CDN | 订阅制高防护CDN | 独立可控、灵活组合的CDN网络。
感谢APIMart对本项目的赞助!APIMart是一个低成本的AI图像和视频生成API平台——GPT-Image-2低至$0.006/张,每***可生成160+张图像。一个异步API同时覆盖图像和视频:提交任务,获取ID,通过轮询或回调获取结果。可批量处理数万张图像而无超时,无需更改代码即可切换模型。按使用付费,无月费——立即注册开始使用。
您的应用只需一个基础URL和一个AccessKey。提供商、账户、凭证、模型和路由策略均在管理UI中配置。
[!WARNING] 如果您正在使用1.x版本,请先阅读从1.x迁移。2.0版本无法就地打开、导入或迁移1.x数据。
需要Docker和Docker Compose。
git clone --depth 1 https://github.com/tbphp/gpt-load.git
cd gpt-load
cp .env.example .env
docker compose up -d
确认服务已启动:
curl --fail http://127.0.0.1:3001/health
首次启动会生成管理密钥。请读取并安全保存:
docker compose exec gpt-load sh -c 'cat /app/data/auth.key'
使用该密钥打开并登录控制台。
[!NOTE] 您也可以在启动前在
.env中显式设置AUTH_KEY。默认情况下,服务仅监听回环地址,不暴露到互联网。
初始设置需要三个步骤:
订阅渠道的OAuth回调端口
Codex、Claude和Antigravity的OAuth客户端使用固定回调端口。Compose会在HOST配置的地址上发布这些端口,默认为127.0.0.1;设置HOST=0.0.0.0会将这些回调端口发布到所有主机接口。由于端口由上游客户端固定,一台主机上一次只能运行一个默认的Compose实例。
通过SSH或远程浏览器操作时,浏览器的localhost可能无法访问GPT-Load——请将完整回调URL粘贴到授权对话框中以完成流程。
使用统一的 DATABASE_DSN 连接 SQLite、MySQL 或 PostgreSQL:
mysql://user:password@db.example:3306/gpt_load?charset=utf8mb4&collation=utf8mb4_bin
postgres://user:password@db.example:5432/gpt_load?sslmode=require
常用操作:
docker compose logs -f # 查看日志
docker compose pull && docker compose up -d # 更新至最新 2.x 镜像
docker compose stop # 停止服务
官方 Compose 文件使用 ghcr.io/tbphp/gpt-load:2。在正式发布(GA)前,2 跟踪经过验证的 2.0 Beta 和 RC 版本;GA 后,仅跟踪稳定的 2.x 版本。精确镜像标签省略 Git 标签的 v 前缀(例如 2.0.0-beta.25),而 2.0-beta 仍为 2.0 Beta 通道。latest 标签仍停留在 1.x 版本。
从 https://github.com/tbphp/gpt-load/releases 下载适用于您平台的构建版本,并首先使用附带的 SHA256SUMS 进行验证:
chmod +x ./gpt-load-linux-amd64
HOST=127.0.0.1 DATA_DIR=./data ./gpt-load-linux-amd64
然后打开 http://localhost:3001 访问管理页面。提供适用于 Linux、macOS(amd64/arm64)和 Windows 共五个目标平台的便携构建版本;gpt-load-windows-amd64.exe 仍像以前一样在前台运行。
Windows 桌面用户可下载 gpt-load-windows-setup.exe。经过一次管理员批准后,安装程序会安装并启动低权限 Windows 服务,启用自动启动,并创建指向 GPT-Load 管理页面的桌面和开始菜单快捷方式。安装程序在完成前会显示生成的管理密钥;请在关闭页面之前保存该密钥。受保护的副本保存在 %ProgramData%\GPT-Load\data\auth.key。服务配置及其 .env 文件位于 %ProgramData%\GPT-Load,持久化数据位于 %ProgramData%\GPT-Load\data。
安装新版本安装程序时,会先优雅停止服务再进行更新。Windows 卸载会移除程序和服务,但保留数据。高级用户仍可使用 gpt-load-windows-amd64.exe service start|stop|restart|status 管理已安装的服务。
启动时,应用程序会读取当前目录下的 .env 文件;已存在的进程环境变量优先级更高。除非另有说明,否则更改配置需要重启进程或容器;通用配置模板参见 .env.example。
所有环境变量说明
| 变量 | 默认值 | 描述 |
|---|---|---|
HOST | 127.0.0.1 | 原生监听地址,也是 Compose 主端口和 OAuth 回调端口的默认主机地址;Compose 容器内始终监听 0.0.0.0。 |
PORT | 3001 | HTTP 服务端口,必须为 1–65535;Compose 还将其用于容器端口、主机发布和健康检查。 |
BIND_ADDRESS | 空,继承 HOST | 仅 Compose;覆盖主服务端口的主机发布地址,不改变 OAuth 回调端口。 |
OAUTH_CALLBACK_BIND_ADDRESS | 空,继承 HOST | 仅 Compose;覆盖固定 OAuth 回调端口 1455、54545 和 51121 的主机发布地址。 |
GRACEFUL_SHUTDOWN_TIMEOUT | 10 | 收到停止信号后等待请求的最长时间,正整数(秒)。 |
CONTAINER_STOP_GRACE_PERIOD | 15s | Docker 等待 Compose 强制停止容器前的持续时间;应长于 GRACEFUL_SHUTDOWN_TIMEOUT。 |
READ_TIMEOUT | 60 | HTTP 请求读取超时,正整数(秒)。 |
IDLE_TIMEOUT | 120 | HTTP 长连接空闲超时,正整数(秒)。 |
DATA_DIR | ./data | 用于管理数据库、auth.key、encryption.key 和运行时状态的目录;官方 Compose 使用 /app/data,Windows 安装程序服务使用 %ProgramData%\GPT-Load\data。 |
DATABASE_DSN | 空,使用 ${DATA_DIR}/gpt-load.db | 留空时使用应用管理的 SQLite;非空值支持 SQLite 路径或 URL、MySQL URL 和 PostgreSQL URL,此时视为操作员管理的外部数据库。容器文件路径必须位于已挂载目录内。 |
DATABASE_MAX_OPEN_CONNECTIONS | 10 | MySQL 和 PostgreSQL 的最大打开连接数,正整数。SQLite 始终使用一个连接。 |
DATABASE_MAX_IDLE_CONNECTIONS | 5 | MySQL 和 PostgreSQL 的最大空闲连接数,正整数且不大于 DATABASE_MAX_OPEN_CONNECTIONS。SQLite 始终使用一个连接。 |
AUTH_KEY | 空,读取或生成 ${DATA_DIR}/auth.key | 管理 UI 和 /api 管理 API 的 Bearer 密钥,非数据平面 AccessKey。 |
ENCRYPTION_KEY | 空,读取或生成 ${DATA_DIR}/encryption.key | 用于加密通道凭据;更改或丢失此密钥会导致现有凭据无法解密,因此需与数据库一起备份。 |
HTTP_PROXY | 空 | HTTP 上游请求的环境代理。 |
HTTPS_PROXY | 空 | HTTPS 上游请求的环境代理。 |
NO_PROXY | 空 | 逗号分隔的主机、域名或 IP,用于绕过环境代理。 |
LOG_LEVEL | info | 支持 panic、fatal、error、warn、warning、info、debug 和 trace;无效值会发出警告并回退到 info。 |
LOG_FORMAT | text | 支持 text 和 json;其他值会导致启动失败。 |
MODELS_DEV_AUTO_SYNC_ENABLED | 未设置,初始默认 true | 未设置时使用持久化的管理 UI 设置;设置后强制启用或禁用 Models.dev 自动同步,并使相同的 UI 选项变为只读。 |
环境代理仅在凭据、分组或全局设置中未指定代理时生效。
127.0.0.1。如需远程访问,需通过受控网络或 TLS 反向代理暴露服务,并配置 ACL 和防火墙规则。AUTH_KEY 和 ENCRYPTION_KEY。切勿将真实密钥提交到代码仓库、日志、截图或公开议题中。previous_response_id 进行的 HTTP 响应续接会自动使用声明了上游管理存储的原生响应路由:目前包括 openai、gpt_load、xai、newapi、cliproxyapi 和 sub2api。所有权通过 AccessKey 隔离,并在当前路由允许时固定原始凭证,与软亲和性无关;实际状态可用性取决于上游。无状态响应和转换后的响应不会注册为持久状态。未知 ID(包括升级前创建的 ID 或网关外创建的 ID)将被拒绝。组参数覆盖无法修改此字段。GET /v1/responses。准入遵循 OpenAI、xAI、Codex 以及兼容的原生 CPA/sub2api 和 GPT-Load 端点所声明的上游能力。客户端可包含布尔值 stream:true/false;两种值均使用 WS 事件流。每一轮交互都会检查当前权限、速率和成本限制以及路由,并生成单独的使用量和成本记录。一个连接保持一个上游身份;不提供 HTTP 回退或对话历史重放功能。responses_websocket_enabled 默认启用。显式的组设置会覆盖全局值;否则组将继承全局值。禁用后会立即关闭受影响的 WS 连接并中断生成过程,但不影响 HTTP/SSE。重新启用不会恢复旧连接的临时状态。stream_id 多路复用和分支功能已为端到端支持该功能的 OpenAI 和 GPT-Load 级联启用。上述其他渠道按顺序运行,并拒绝命名流。预热会向上游发送 generate:false。Codex 续接需要原始活动连接:不支持 store:true 以及通过新连接使用旧 ID 进行恢复。其他渠道的持久续接取决于存储能力和有效的所有权。现有的 Codex SDK 代理、读取和关闭限制 仍然适用。conversation 和其他现有资源 ID 不在此所有权路由范围内,仍依赖于单个凭证或跨凭证的上游资源共享。[!WARNING] GPT-Load 2.0 是完全重写的版本。它无法就地打开、导入或迁移 1.x 数据。
使用独立的数据库、DATA_DIR、端口和 Docker 卷部署 2.0 版本。仅在验证后切换流量,并保留原始 1.x 部署直至回滚窗口关闭。1.4.x 维护版本的文档位于 官方文档。
GPT-Load 的部分功能基于以下项目构建,在此表示感谢:
| 项目 | 作用 | 许可证 |
|---|---|---|
| https://github.com/maximhq/bifrost | 提供商认证、请求/响应转换、流式传输、使用量标准化 | Apache-2.0 |
| https://github.com/router-for-me/CLIProxyAPI | 订阅渠道的 OAuth 和执行适配器 | MIT |
| https://github.com/lobehub/lobe-icons | 管理 UI 中的渠道品牌图标 | MIT |
GPT-Load 负责凭证存储、账户选择、调度、重试、健康检查、亲和性、日志记录和使用策略。第三方声明位于 THIRD_PARTY_NOTICES.md,完整许可证文本位于 LICENSES/,每个版本均附带涵盖 Go 依赖图的 CycloneDX SBOM。
渠道图标标识其各自的上游提供商。所有商标均归其所有者所有;本项目不隶属于任何提供商,也未获得其背书。
Platform support
Community support
Infrastructure support
MIT 许可证 · 第三方声明 · 安全策略
来自真实用户的反馈,见证轩辕镜像的优质服务