轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥8起我的订单
文档
工具
提交工单页面收录
ghcr.io/diegosouzapw/omniroute

ghcr.io/diegosouzapw/omniroute:3.8.51-bun

ghcr.iolinux/amd643.8.51-bun大小: 777.68 MB更新于 2026年10月7日
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这段话即可:

请先阅读并遵守:https://xuanyuan.cloud/agents.md

未读文档前不要生成 pull 命令或排错方案。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

🚀 OmniRoute — 免费 AI 网关

💰 每月约 16.2 亿免费 Token

手动叠加各服务商的免费配额十分繁琐:你需要对接数十套 SDK、应对数十种速率限制,还无从得知自己实际可用的 Token 总量。OmniRoute 收录了35 个共用配额池下的 489 条免费层级条目,基于17 个有公开月度正额度的配额池,加上 Groq 的 5 个单模型上限计算出主页的总 Token 数值,且已对共享配额池做过去重。仅通过区域身份校验才能解锁的配额(当前为 ModelScope)会单独展示,区域身份验证后可额外获得约 600 万 Token,这部分不会计入主页的总数值。所有结果均可在面板的 /dashboard/free-tiers 路径下查看。

以上内容是实时 /dashboard/free-tiers 页面的动态说明。完整计算方法(配额池去重、额度层级、服务商条款)请参考:docs/reference/FREE_TIERS.md

这些数值每两周会对照实时收录库重新审计,数值可能双向变动:若某服务商终止免费层级,总数值会下降;若新增免费服务商,总数值会上升。我们仅输出收录库实际计算得到的结果,绝不会向上取整得到不符合实际的理想最大值。

如果 OmniRoute 帮你节省了成本、简化了工作流程,请给本仓库点个 ⭐ Star。

💬 加入社区

👋 关注维护者 — 第一时间获取新服务商接入、版本发布与使用技巧:

📈 持续迭代的网关

v3.8.49v3.8.50v3.8.51+
🌐 接入服务商总数290357更多待接入队列
🧠 唯一聊天模型 ID 数11851312—
🖼️ 多模态桥接—🆕 支持视觉、音频、视频—
📡 Radar 免费目录—🆕 可选开启—
⚖️ 配额感知调度—🆕 新增 Quota-Share 模式—
📊 配额遥测—🆕 实时数据—

→ 路线图 — 稳步推进至 v3.9.0 LTS 版本

🧩 内容导航

🚀 入门 🚀 快速开始 📦 安装 🆓 零配置

💡 了解 💥 核心承诺 🤔 为什么选择 OmniRoute 🏆 核心差异化优势

⚙️ 功能 🎯 组合路由 🌐 服务商 🔌 CLI 与 MCP

🗜️ 压缩 🖥️ 运行环境 🔒 私有化部署

👀 查看演示 🎬 实际运行效果 ✨ 更新日志 🤖 兼容的 CLI 工具

💚 支持 💚 赞助与支持 💬 社区 💖 赞助商

📦 项目信息 🛠️ 技术栈 📖 文档 👥 贡献者

🌐 支持 67 种语言

🆓 安装即可用 — 无需密钥,无需额外配置

# 全新安装,无需配置任何凭证 — `auto` 模式开箱可用:
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'

想要指定使用某个免费后端?可以直接调用 oc/…(OpenCode 免费通道),后续再切换到 auto 模式让 OmniRoute 自动选择最优链路。

📦 可直接复制使用的 Python、Node.js、PHP、cURL 快速入门脚本 → examples/quickstart/

💥 核心承诺

🤔 为什么选择 OmniRoute?

🤝 开源伙伴支持

想要成为 OmniRoute 的开源伙伴? 这些企业支持开源生态、助力 OmniRoute 持续迭代,我们会公开公示他们提供的每一笔 Token 的用途。合作请联系:***

Kimi Moonshot AI

感谢创始级开源伙伴 Kimi(月之暗面)对本项目的支持!Kimi 是推出开源权重 K2、K3 模型系列的 AI 实验室,其中 Kimi K3 支持 100 万 Token 上下文窗口、原生视觉能力与前沿级代码生成能力,价格仅为闭源模型的零头,可直接与 Claude Code、Codex 及 OmniRoute 支持的所有代码开发工具无缝适配。

Kimi 的支持用途:Kimi 的 API 额度用于支撑 OmniRoute 的 AI 校验发布流水线 — 每个 Pull Request 发布前都会通过 Kimi K3 阶段进行自动评审,同时也支撑日常功能开发。OmniRoute 对 Kimi 提供一等公民级支持,覆盖两条链路:直接调用 Kimi API 的 kimi-k3 模式,以及支持 OAuth 和 API 密钥的 Kimi Code 代码开发方案。OmniRoute 也是 Kimi 支持计划中首个巴西开源项目。领取 Kimi API 密钥可额外获得 15% 赠额 →

Cheaper Inference cheaperinference.com

感谢开源伙伴 Cheaper Inference 对本项目的支持!Cheaper Inference 是一个按成本排序的网关,在单一 OpenAI 兼容端点后对接了 42 款前沿模型(包括 Claude、GPT-5.x、Gemini、Kimi K3、GLM、DeepSeek、Grok、MiniMax),可将每个请求路由至符合要求的最便宜服务商,定价绝不会超过模型厂商的官方指导价。

OmniRoute 提供一等公民级支持:覆盖聊天补全、原生 /v1/responses 端点、视觉、工具调用能力,以及 3 款图像生成模型(grok-imagine、nano-banana-pro、nano-banana-2,可通过 cheaperinference/<模型名> 路径访问)。获取 API 密钥 →

标记有 aff=omniroute 的链接为合作推广链接,你点击后不会产生任何额外费用,同时会为本项目提供资金支持。

🎟️ 联盟推广优惠 — 非赞助服务商提供的免费注册优惠券(点击展开) 本节仅用于展示推荐链接和优惠券码。上文「🤝 开源伙伴支持」部分为官方赞助合作。本节列出的服务商与 OmniRoute 不存在任何赞助或合作关系,所有列出的优惠券均为公开可用的通用优惠。

AgentRouter agentrouter.org

AgentRouter 联盟注册入口 · 注册即得 100 ***免费额度(提供免费服务器,延迟相对较高 — 推荐用于测试场景,不建议生产使用)。OmniRoute 从 v3.8.50 版本开始提供一等公民级支持:覆盖聊天补全、Anthropic 兼容传输格式与 OpenAI 兼容路径,可用模型包括 claude-opus-4-8、claude-opus-5、gpt-5.6-sol 等。领取你的 100 ***额度 →

[!WARNING] 联盟推广链接 — OmniRoute 与该服务商不存在任何赞助或合作关系。

如果你知道其他面向 OmniRoute 用户提供大额免费注册优惠券的服务商,欢迎提交 Issue 告知我们,我们会将其添加至此处。

🎯 核心特色:组合路由

组合路由(combo) 是 OmniRoute 自动跨多个模型执行的路由链路:当配额耗尽、服务商故障或成本突增时,组合路由会自动切换至下一个符合条件的健康模型,全程自动容灾。🛡️

⚡ 零配置 — 直接使用 auto 模式

无需手动创建组合路由,只需将模型参数设为 auto(或对应变体),OmniRoute 就会基于你已接入的服务商实时计算评分,自动生成虚拟组合路由:

模型 ID优化目标
auto 🎯平衡默认模式(LKGP 策略 — 优先使用你上一次正常调用成功的服务商)
auto/coding 🧑‍💻代码生成场景优先保障质量的权重配置
auto/fast ⚡优先选择最低延迟的链路
auto/cheap 💰优先选择单位 Token 成本最低的链路
auto/offline 🔋优先选择配额/速率限制剩余空间最大的链路
auto/smart 🔭质量优先 + 10% 探索权重,自动发现表现更优的模型
auto/lkgp 📌显式开启「最后已知正常服务商」粘性策略
auto/chaos 🧪并行向一组模型发起请求(默认 5 个,每个服务商一个),返回第一个成功结果;仅向面板内每个上游模型发起一次调用,不属于故障注入场景

🔀 也支持自定义 — 共 19 种路由策略

全部 19 种策略均可使用,你可以在组合路由的每一步按需自由组合搭配:

序号策略名称功能说明
1priority按目标优先级排序的有序列表 — 耗尽前一个目标的全部配额后再切换到下一个 🥇
2fill-first完全用尽当前目标的所有配额后,再切换至下一个目标
3weighted按每个目标配置的权重执行加权随机路由

4 round-robin 按顺序轮询遍历所有目标节点

5 p2c 基于二次选择的随机负载均衡算法

6 least-used 选取当前负载最低的目标节点

7 random 无重复的均匀随机选取策略

8 strict-random 允许出现重复结果的纯随机选取 🎲

9 cost-optimized 基于实时目录定价将单请求成本降至最低 💸

10 headroom 选取剩余配额最多的目标节点

11 reset-window 优先选取配额窗口即将重置的目标节点

12 reset-aware 按配额重置时间排序,优先选用即将重置的短窗口节点 📊

13 context-relay 跨目标节点传递上下文,适配长对话场景 🧠

14 context-optimized 选取最适配当前上下文大小的目标节点

15 cache-optimized 将每个可复用的提示词前缀固定绑定到同一账号,最大化提示词缓存命中率 🎯

16 lkgp Last-Known-Good Path,即最后可用路径:优先绑定至上一次运行成功的服务提供商,失败后再回退至通用路由规则

17 auto 基于16项指标对所有连接进行实时综合评分 🤖

18 fusion 同时将请求分发至多模型评审面板,由汇总模块整合输出最终结果 🧬

19 pipeline 链式执行步骤:前一个目标节点的输出将作为下一个节点的输入 🔗

Auto-Combo 引擎会基于 16 项维度(运行健康度、配额剩余量、调用成本、延迟、任务匹配度、输出质量、会话可用性等)为所有候选路由打分,详情可参考 docs/routing/AUTO-COMBO.md。


🧱 内置三层独立弹性能力

📖 Auto-Combo 引擎说明 · 弹性架构指南

🏆 OmniRoute 的核心差异化特性

📊 完整方法论与各功能细节对比(覆盖 9router、OpenRouter、CLIProxyAPI 与 LiteLLM),请查看 → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md

💚 支持 OmniRoute 项目

OmniRoute 采用 MIT 许可证开源维护。如果本项目为你节省了时间或成本,你可通过以下任意适合你的方式支持项目保持独立运营:所有赞助行为都不会影响路由优先级,赞助仅用于项目曝光,不会为赞助方提供路由排序特权。

⭐ Star 项目仓库 完全免费,对项目曝光度有实质性帮助 Star OmniRoute 🐙 GitHub *** 支持一次性或月度赞助,平台零手续费 github.com//diegosouzapw ☕ *** 快速一次性,捐助方无需注册账号 .com/diegosouzapw 🧋 Buy Me a Coffee 轻量非正式赞助通道 buymeacoffee.com/diegosouzapw 🖐 *** 支持定期赞助,由非盈利开源平台运营 .com/diegosouzapw 🇧🇷 PIX(巴西本地支付) 即时到账零手续费,密钥与见下文 ₿ 加密货币 支持 BTC、ETH、USDT-TRC20、USDC-,地址见下文

🇧🇷 巴西 PIX 支付 — 即时到账零手续费

随机密钥:5d865059-bc44-483a-962d-43ceb80126eb

PIX 复制粘贴内容:

00020101021126580014br.gov.bcb.pix01365d865059-bc44-483a-962d-43ceb80126eb5204000053039865802BR5922OMNIROUTE CONTRIBUICAO6006BRASIL62070503***630475DD

₿ 加密货币 — BTC · ETH · USDT-TRC20 · USDC-***(点击展开) ₿ BTC ***(SegWit 地址) *** Ξ ETH ***(ERC20 地址) *** ₮ USDT Tron(TRC20 地址) TKAF41JpuQrHbKTnsQa9svJE2T192Hvsc2 $ USDC *** 地址 2emNNZzVVWQc3FQ2wk9M6qXUQmW8AKdjjL174fXR28Tu

[!WARNING] 请仅使用对应币种标注的指定网络转账,转入错误网络将导致资金永久丢失。

🐛 发现 Bug 或有任何反馈?欢迎提交至 https://github.com/diegosouzapw/OmniRoute/discussions 板块。

开发者注意事项:为方便开发者使用,本项目在 npm install 或安装后置钩子执行过程中可能会生成本地 .env 文件。该文件已通过 .gitignore 配置被自动忽略(可查看 .gitignore 文件确认),严禁提交至代码仓库。如果不慎误提交,请立即轮转所有已暴露的密钥并从仓库历史中彻底移除该文件。本地环境文件与密钥管理的详细规范请参考 docs/DEVELOPER-ENVIRONMENT.md。

📡 OmniRoute 实时数据雷达

基础免费层级的核心可用额度保持在 每月约 16.2 亿 Tokens(基于前述已完成池去重的公开目录统计)。服务提供商临时新用户注册赠送额度可将首月可用额度临时提升至 约 22.2 亿 Tokens。Radar 是可选的签名目录覆盖服务,用于在 OmniRoute 正式版本发布间隙提供更新的免费模型可用性数据;社区版目录以及所有现有免费功能将永久保持免费开放。

项目赞助者可获得实时目录与额外的服务提供商接入权益。该权益对应的独立可变额度上限最高约为 每月 30 亿 Tokens,具体数值随服务提供商的可用状态动态调整。该上限不作任何保证:所有服务提供商均可能随时调整配额、准入规则、支持模型或可用区域。

Radar 采用用户主动选择接入模式,且仅支持 GET 请求调用。OmniRoute 客户端不会上传任何提示词、流量数据、服务提供商配置、使用遥测数据或本地公告关闭状态。资格规则与当前目录详情可访问 radar.omniroute.online/planos 查看。

✨ 近期更新内容

以下是 v3.8.20 至 v3.8.50 版本的重点更新记录,完整变更历史请查看 CHANGELOG.md。

  • 🎛️ OmniConductor — 支持入站 A2A 委托至您的代理集群,可在 Agent 卡片上查看 Conductor 技能,搭配集成 Faro 一键通语音聊天的仪表板面板。→ A2A 服务器
  • 🛂 自适应准入与过载保护 — 高负载聊天请求将进入队列等待,而非直接返回 503,同时为每个连接提供原子级 RPM 滚动租约机制。→ 弹性指南
  • 🗂️ 标准 /v1/models 排序 — 按提供商分组生成连续区块(优先固定组合模型),在所有目录源中保持排序稳定。→ API 参考
  • 🗜️ 压缩加固 — 默认启用膨胀防护,内置适用于德语、法语、日语及文言文的 Caveman 压缩包,提供面向 Gradle 和 .NET 的 RTK 过滤器。→ 压缩引擎
  • 💸 透明统一费率成本统计 — 订阅制/按量付费编码类提供商在成本分析中显示为 $0,预算、配额和路由功能仍可正常执行估算。→ API 参考
  • ⚖️ 配额共享路由 — 将共享账号的配额在池化密钥间公平分配,采用工作守恒机制,闲置配额额度可自动出借。→ 弹性指南
  • 🤖 一键 CLI/代理搭建 — 提供 13 个已注册的 setup-* 命令;执行 omniroute run 即可启动 7 款 CLI(Claude Code、Codex、Aider、Goose、OpenCode、Qwen Code、Gemini CLI);omniroute configure 支持 10 个配置目标,内置交互式提供商与模型选择器,支持按上下文保存偏好。→ CLI 集成
  • 🛰️ 远程模式 — 通过作用域令牌(connect / contexts / tokens)驱动远程 OmniRoute,搭配适用于 VPS 部署的 antigravity OAuth 辅助工具。→ 远程模式
  • 🧭 智能自动路由 — 支持 auto/ : 组合、Fusion(模型面板 + 判决器)、任务感知路由,可针对单个请求覆盖模型、模式及 USD 预算设置。→ 自动组合路由
  • 🗜️ 可插拔压缩 — 提供 12 种可组合引擎及压缩工作室功能:包含 LLMLingua-2、两级 Ultra 压缩、omniglyph、单步保真门、GCF v3.2、拖拽排序编辑器。→ 压缩引擎
  • 🕵️ 透明 MITM 解密(TPROXY) — 可捕获忽略代理环境变量的 CLI 请求,搭配基于 SNI 的独立 CA 与信任存储安装程序。→ MITM/TPROXY 解密
  • 💸 全链路成本遥测 — 所有端点均返回 X-OmniRoute-* 成本/用量头,包含缓存命中节省标识头,支持按密钥设置 USD 消费配额。→ API 参考
  • 🧠 可控内存功能 — 默认关闭,可自主选择启用 int8 向量量化与类型化衰减,同时支持通过单请求参数 x-omniroute-no-memory 临时关闭。→ 内存模块
  • 🛡️ 安全机制 — 所有 LLM 路由均内置提示注入防护(配套红队测试套件),可自主选择启用凭证屏蔽护栏,双向脱敏泄露的 API 密钥与机密信息,内置免费 DuckDuckGo 兜底网页搜索功能,仪表板支持可选 OIDC 登录门禁,密码登录将始终可用。→ 防护机制
  • 🖼️ 新增端点 — 新增 /v1/ocr(基于 Mistral OCR)与 /v1/audio/translations(类 Whisper 能力)端点,完善媒体处理能力覆盖。→ API 参考
  • 🎨 图像/视频/音频生成 — 统一媒体 API 入口,支持 xAI Grok Imagine、Novita AI 视频、ComfyUI、Magnific、Adobe Firefly、Segmind 以及 ElevenLabs 等语音服务提供商。→ API 参考
  • 🌍 部署与运维能力 — 支持反向代理 basePath、浏览器语言自动检测、按密钥设备追踪、无根 MITM 信任、繁体中文(zh-TW)本地化。→ 环境配置
  • 🤝 更多提供商与代理支持 — 新增云代理(Codex Cloud、Cursor、Devin、Jules)、支持带浏览器与 OAuth 登录的 Grok Build(xAI)、Ollama 专属一级卡片、Claude Opus 5 与 Sonnet 5、Kimi 官方合作(代码/网页/月之暗面)、Zed、Requesty、SenseNova、元宝、Agnes AI… 全线刷新为 352 家提供商的目录。→ 提供商参考
  • 📡 路由透明性 — 每个响应均携带 X-OmniRoute-Decision 头,标注实际服务的路由策略、提供商与延迟数据;新增 cache-optimized 组合策略以及 Auto-Combo 的 cacheAffinity 因子,可将重复请求路由回持有缓存前缀的连接;提供只读端点 /v1/auto-combo/{channel}/candidates,暴露 auto/* 通道的实时候选池。→ 自动组合路由
  • ⚡ 本地性能与基础设施 — 一键部署本地 Redis,提供 Cloudflare Workers / Deno Deploy 中继部署工具,将 Bifrost 与 Mux 作为托管嵌入式服务运行。→ 嵌入式服务
  • 🧩 其他内置功能 — 插件框架与插件市场、Omni/Agent/GitHub 技能框架、Obsidian 库集成(22 个 MCP 工具)、兼容 OpenAI 规范的 Batch 与 Files API、语义化响应缓存、排行榜激励机制、ACP 代理发现(内置 15 个代理)、定时导出日志至 BigQuery、auto/chaos 并行多模型扇出、*** 机器人桥接、应用内版本管理器以及 LMArena-ELO 免费提供商排名。→ 文档首页

🤖 兼容 CLI 与编码代理

仅需一个配置项 http://localhost:20128/v1 — 所有 AI IDE 或 CLI 均可运行在免费或低成本模型上。

Claude Code Codex CLI Cline Kilo Code Zoo Code Continue

Aider ForgeCode jcode DeepSeek TUI CodeWhale OpenCode

Factory Droid Copilot CLI Cursor CLI Smelt Pi Grok Build

Hermes Agent OpenClaw Goose Open Interpreter Warp AI deyin.ai

+ 同时兼容 · Agent Deck · Kiro · Command Code · Antigravity · Windsurf · AMP · 所有兼容 OpenAI 规范的工具

📖 全部 36 款工具(26 个 CLI 编码工具 + 10 个 CLI 代理)的分步配置指南 → docs/reference/CLI-TOOLS.md · 🧩 OpenCode 插件 → https://www.npmjs.com/package/@omniroute/opencode-provider

通过 OmniRoute 单命令启动任意支持的 CLI — 无需写入配置文件, 凭证按进程独立注入,Qwen/Gemini 会获得临时隔离的运行主目录:

omniroute run claude --model openai/gpt-5.4 # Claude Code
omniroute run codex --model glm/glm-5.2 # OpenAI Codex CLI
omniroute run aider --model glm/glm-5.2 -- --message "reply OK"
omniroute run goose --model glm/glm-5.2
omniroute run opencode --model glm/glm-5.2 -- run "reply OK"
omniroute run qwen --model glm/glm-5.2 -- -p "reply OK"
omniroute run gemini --model glm/glm-5.2 -- --skip-trust -p "reply OK"

# 也可以交互式选择提供商+模型并自动写入对应工具的自有配置:
omniroute configure codex # 还支持以下工具:claude opencode qwen aider goose gemini cline continue kilo

所有命令均会遵循当前生效的远程上下文(由 omniroute connect 设置),--dry-run 参数可以直接预览最终生成的环境变量与调用参数,不会实际执行命令,而 --api-key-env NAME 支持指定从指定环境变量读取密钥,避免密钥泄露到 shell 历史记录中。→ CLI 集成指南

🌐 357 个 AI 提供商 — 其中 152 个已在目录中标注为免费

官方收录的标准聊天、媒体、搜索、本地、云代理与系统分类下共有 357 个已注册提供商,其中 152 个携带 hasFree: true 发现元数据。聊天模型注册表覆盖 229 个提供商 / 2554 组唯一的提供商-模型配对 / 1283 个原始模型 ID;独立的免费额度目录中包含 491 条按模型划分的记录、35 个循环额度资源池 以及 54 个无需密钥、永久免费的循环提供商。这些统计口径为有意差异化设计,具体定义与去重后的资源池计算规则可查阅 提供商参考文档 和 免费套餐说明。

🏢 所有主流大模型厂商 — 仅通过一个端点即可访问

OpenAI                             Anthropic                             Gemini                             xAI Grok                             DeepSeek                             Mistral                            

Qwen                             Meta Llama                             Groq                             NVIDIA                             MiniMax                             Cohere                            

Perplexity                             HuggingFace                             Together                             Fireworks                             Cloudflare                             百度                            

……以及其余 330+ 个提供商 — 所有提供商图标均直接从仪表板的提供商目录实时拉取。📖 提供商参考文档

🆓 永久免费 — 0 成本,无需绑定***

OpenCode Zen DeepSeek V4、Nemotron 3 无 token 上限 Kilo Code 自动路由、腾讯 Hy3 永久免费 Requesty GPT-OSS 120B、Nemotron 永久免费 SiliconFlow DeepSeek V3.2 / R1 免费套餐 Z.AI GLM GLM-4.7 / 4.5-Flash 永久免费 百度文心一言 ERNIE 4.0 永久免费

Qoder AI Qwen3-Max、Kimi-K2 不限量免费 Pollinations GPT、Llama、Claude 无需密钥即可使用 Cloudflare AI 50+ 模型 每日 10K 神经元调用额度 NVIDIA NIM GLM、MiniMax 约 40 RPM 免费额度 Cerebras GLM 4.7、GPT-OSS 每日 1M token 额度 OpenRouter :free 分类模型 + 赠送 10 ***额度 → 支持更高调用速率

📖 完整机器可读目录 → docs/reference/PROVIDER_REFERENCE.md

🖥️ OmniRoute 运行环境 — 任意平台均可部署

同一套程序,运行在你的设备上,完全由你掌控。既可以全局通过 npm 安装使用,也能借助 Termux 在你的手机上运行。

平台安装亮点

平台安装方式说明
📦 npm(全局安装)npm install -g omniroute 一条命令即可完成安装,支持任意操作系统
🐳 Dockerdocker run … diegosouzapw/omniroute 支持多架构 AMD64 + ARM64
🖥️ 桌面端(Electron)npm run electron:build 提供原生窗口与系统托盘,兼容 Windows / macOS / Linux
🎩 菜单栏程序(OmniRouteTray)brew install --cask zoispag/tap/omniroute-tray 负责服务托管与自动更新,专为 macOS 设计
💪 ARM 原生支持arm64 架构原生适配,可运行于树莓派、ARM 服务器、Apple Silicon 设备
📱 安卓(Termux)pkg install nodejs && npx -y omniroute 可直接在手机上 24 小时运行,无需 root 权限
📲 PWA 渐进式网页应用浏览器内点击「添加到主屏幕」即可获得全屏、离线可用的可安装体验
🧩 OpenCode 插件@omniroute/opencode-provider 原生集成进 OpenCode
🤖 VS Code Copilot 聊天安装 OmniCopilot 扩展后,所有 OmniRoute 提供的模型均可直接显示在原生 Copilot 聊天选择器中,同时支持稳定版与 Insider 版 VS Code
🛠️ 源码编译npm install && npm run dev 可自行修改源码二次开发、提交贡献

📖 Docker 使用指南 · 桌面端文档 · https://github.com/zoispag/omniroute-tray · Termux 使用指南 · PWA 使用指南 · OpenCode 集成说明

🧩 新特性:直接在 VS Code 原生 Copilot 聊天中使用 OmniRoute

无需额外打开新侧边栏、无需适应新聊天 UI — 你已经在使用的 Copilot 聊天模型选择器 中就会直接显示所有 OmniRoute 提供的模型。自 VS Code 1.122 版本起,第三方提供商模型无需登录 GitHub 账号、也无需订阅 Copilot 即可使用,代理模式、工具调用、视觉理解功能全部免费开放。

安装 https://github.com/diegosouzapw/OmniCopilot 扩展,将其指向你的 OmniRoute 服务端(默认地址为 localhost:20128),随后打开 Copilot 聊天 → 点击模型选择器 → 管理模型… → 选择 OmniRoute 即可使用。

应用商店兼容产品
🧩 VS Code 应用市场安装后可在 VS Code 稳定版与 Insider 版中使用
🔓 Open VSX 注册表安装后可兼容 Cursor、Windsurf、VSCodium、Theia、code-server、Gitpod、Antigravity、Kiro……等产品

你也可以直接在编辑器内打开 扩展 面板,搜索 "OmniRoute" 后点击安装即可,两个应用商店的操作流程完全一致。扩展的源码、问题反馈与发布操作手册均托管在 https://github.com/diegosouzapw/OmniCopilot 仓库中。

📖 VS Code Copilot 聊天配置指南 — 包含完整设置流程、选择器显示规则、内置仪表板功能说明与故障排查方案

🎩 新特性:OmniRouteTray — 常驻菜单栏的服务入口

omniroute serve 长时间运行的最佳实践就是保持后台常驻。https://github.com/zoispag/omniroute-tray 是一款专为 macOS 设计的免维护菜单栏应用:它会自动启动服务,设备重启后也能保证服务正常运行,支持原地自动更新,且只需点击一次即可查看当前实时 token 额度 — 无需保持终端窗口常开,也不需要手动值守管理全局安装的 npm install -g omniroute。

该程序基于体积极小的 Rust 核心框架 https://v2.tauri.app/ 开发,内置已签名的 Node 24 运行时,独立管理自有 OmniRoute 实例,完全不会和你系统中已有的全局 node/bun 环境产生冲突。它会 复用你已有的 ~/.omniroute/ 配置文件与数据库,和你手动运行的 OmniRoute 数据完全互通,相当于给原生程序加了一层便捷的托盘外壳。🎩

功能实现效果
🟢 服务托管自动拉起 omniroute serve,如果检测到已有运行中的实例会直接复用,不会重复启动
📊 用量一览直观展示提供商配额进度条、Claude 会话/周度限额与重置倒计时、30 天消费明细
🔄 原地自动更新采用分阶段安装、原子替换机制,更新失败时自动回滚,始终运行最新版本
🚀 开机自启可选开机自动启动,完全托盘运行,不会在 Dock 栏显示图标
🩺 诊断与日志一键运行环境诊断与直接访问服务运行日志
brew install --cask zoispag/tap/omniroute-tray

偏好下载本地安装包?可直接从 https://github.com/zoispag/omniroute-tray/releases 获取最新 .dmg 安装包。源代码、问题反馈与构建文档托管在 zoispag/omniroute-tray 仓库。 💛 这是由 @zoispag 维护的社区项目,并非 OmniRoute 官方发布版本。

🔒 隐私优先 · 本地原生架构

📖 授权机制指南 · 安全防护规则 · 合规性说明

🔌 全功能 CLI + A2A 与 MCP 协议支持

除核心服务端能力外,OmniRoute 是一款配备 80+ 命令的完整命令行操控座舱,同时开放主流智能体协议,支持 AI 智能体自主驱动平台运行。

⌨️ 真正的全能力 CLI(绝非仅支持 start 命令)

omniroute # 启动网关与控制面板,默认占用端口 20128
omniroute chat # 交互式 TUI 聊天客户端,支持 /model /combo /skill /memory 等斜杠命令
omniroute setup # 引导式首次运行配置向导
omniroute doctor # 诊断服务提供商、端口、原生依赖的运行状态

🛰️ 远程模式:本地运行 CLI,OmniRoute 部署在 VPS 上

OmniRoute 部署在远端服务器后,你可以在本地笔记本上使用同一套 CLI 操控远端服务。只需使用作用域访问令牌登录一次,后续所有命令都会定向到远端实例执行。

omniroute connect 192.168.0.15 # 输入密码换取带作用域的令牌,保存为本地上下文
omniroute models # ← 该命令将在远端服务器执行
omniroute configure codex # ← 选择远端模型,生成本地 Codex 配置文件
omniroute tokens create --name ci --scope read # 为其他机器生成权限更受限的令牌
omniroute contexts use default # ← 切回本地服务器实例

令牌支持 read / write / admin 三类作用域,所有进程生成路由默认仅允许环回访问。 📖 远程模式使用文档

🤝 接入智能体,让它自主控制 OmniRoute

你可以通过 MCP、A2A、REST API、Webhooks 或远程 CLI 暴露 OmniRoute 服务,任何合规的智能体(或你自定义的代码)都能获得网关的完整操控权限:自主完成路由调度、服务提供商配置、组合策略调整、缓存管理、压缩控制、内存读写等全流程操作。所有 HTTP 端点默认挂载在 http://localhost:20128 路径下。

接口类型端点 / 命令适用场景
🧰 MCP (stdio)omniroute --mcp接入 Claude Desktop、Cursor 等所有 MCP 客户端
🌊 MCP (HTTP)/api/mcp/stream远程 MCP 服务:内置 110 个工具,33 项权限作用域(可自主选择是否启用强制校验),提供完整审计追踪
📡 MCP (SSE)/api/mcp/sse流式 MCP 传输通道
🤝 A2A/.well-known/agent.json智能体间通信,基于 JSON-RPC 2.0 + SSE 实现,内置 6 项能力
🌐 REST API/v1/*兼容 OpenAI 接口规范:支持对话、向量嵌入、图片、音频、OCR 能力
🔔 Webhooks/api/webhooks将请求、配额事件推送至 Slack、、 或任意自定义地址
🛰️ Remote CLIomniroute connect通过带作用域的访问令牌操控远端实例
# 通过 MCP 为 Claude Code 授予完整的 OmniRoute 工具集访问权限:
claude mcp add-server omniroute --type http --url http://localhost:20128/api/mcp/stream

📖 MCP 服务文档 · A2A 服务文档 · 智能体协议指南

🗜️ 自动实现 15–95% Token 节省

📖 工作原理:流水线架构与节省率计算逻辑

默认堆叠组合策略按 RTK → Caveman 顺序执行压缩,当两个引擎同时作用于同一工具/上下文负载时,Token 节省率会叠加:

combined = 1 − (1 − RTK) × (1 − Caveman_input)
average = 1 − (1 − 0.80) × (1 − 0.46) = 89.2%
range = 78.4 – 94.6%

代码块、URL、JSON 与所有结构化数据都会受保留引擎保护,不会被压缩修改。

🧱 12 引擎压缩栈

引擎按流水线顺序运行,每个引擎都支持独立开关,也可针对不同组合策略单独配置:

#引擎名称功能说明
1Session-Dedup移除多轮对话中重复出现的内容(基于内容寻址、跨轮检测)
2CCR将大体积内容块归档并替换为检索标记,按需拉取原始内容
3Lite空白字符与图片 URL 裁剪,低延迟轻量基线优化
4RTK智能工具返回结果过滤、去重与截断,支持命令识别适配
5Responses Tool Output针对 shell、补丁、搜索、构建输出的无损优先 JSON 压缩与边界诊断压缩,适配 Responses API
6Headroom基于自研 GCF 编解码器实现无损 JSON 数组紧凑压缩,平均体积减少约 30%
7Relevance针对上一轮用户查询做句子提取与相关性评分,过滤无关内容
8Caveman规则化文本压缩,常规 prose 内容输出体积减少约 65–75%
9Aggressive摘要生成 + 旧对话轮次渐进式老化淘汰
10LLMLingua-2基于 MobileBERT ONNX 的机器学习语义裁剪,代码安全性有保障,异步执行
11Ultra启发式 Token 裁剪,可选择接入小模型(SLM)层级增强效果
12OmniGlyph实验性上下文图像编码,经实测适配 Anthropic 直连链路下的 Claude Fable 5 场景;GPT 5.6 转换器目前处于故障关闭状态,待服务商反馈后开放。

平台提供四种压缩预置配置:激进默认、平衡、代码安全、透传,最激进模式需手动开启。

所有代码块、URL 与结构化数据都会字节级完整保留,不会出现信息丢失。平台还提供一键预设配置组合多个引擎:

模式节省率适用场景
🪶 Lite~15%始终开启的安全默认模式
🪨 Standard (Caveman)~30%日常编码场景
⚡ Aggressive~50%长会话、工具调用密集场景
🔥 Ultra~75%最大化 Token 节省
🧰 RTK60–90%Shell、测试、构建、Git 输出场景
🔗 Stacked (RTK → Caveman)78–95%混合提示词 + 工具日志场景

标准模式真实样例:

压缩前(69 tokens): "The reason your React component is re-rendering is likely because you're creating a new object reference on each render cycle. When you pass an inline object as a prop, React's shallow comparison sees it as a different object every time, which triggers a re-render. I would recommend using useMemo to memoize the object."

压缩后(19 tokens): "New object ref each render. Inline object prop = new ref = re-render. Wrap in useMemo."

答案语义完全一致,Token 减少 72%,准确率零损失。 ✅

葡萄牙语(PT-BR)样例 — https://github.com/leninejunior/troglodita 模式:

压缩前(42 tokens): "O problema é que o componente está re-renderizando porque uma nova referência de objeto está sendo criada em cada ciclo de renderização. Eu recomendaria usar useMemo."

压缩后(12 tokens): "Re-render: ref nova cada ciclo (objeto inline recriado). Usar useMemo."

答案语义完全一致,Token 减少约 70%,技术精度不受影响。 ✅

🎚️ 引擎之外的扩展能力:输出样式、自适应调节盘与单请求级控制

以上 12 个引擎负责缩减输入侧的 Token 体积,另外三层配置可自定义压缩的实现方式、触发时机以及最终输出效果:

  • 🪄 输出样式(输出轴控制)—— 注入确定性、缓存安全的响应塑形指令;各类样式可组合使用,每类均提供 lite / full / ultra 三档强度。添加样式仅需一行注册表条目:
    • 精简行文 — 剔除冗余填充词、冠词与模糊表述,完整保留技术实质信息。
    • 最小代码 — 遵循「资深懒开发者 YAGNI 原则」:仅提交可运行的最小变更,不生成任何未要求的脚手架代码。
    • 溯因模式(资深懒开发者) — 进阶 YAGNI 实现,定位并修复根因,输出最小可用差异集。
    • ADHD 行动优先 — 以下一步行动为核心,采用编号步骤,仅输出单个明确的后续动作,无前置铺垫内容。
    • 精简 CJK(文言) — 类古文超精简风格(仅对 zh 语言区域生效)。
  • 🎯 自适应上下文配额(调节旋钮)—— 摒弃单一固定开启/关闭的 token 阈值机制,仅在必要时逐步调用成本最低、信息损失最小的压缩引擎,确保内容完全适配模型上下文窗口。可用策略:reserve-output(默认,自适应模型能力)· percentage · absolute。可用模式:floor(强制保证内容适配)· replace-autotrigger(用户显式配置优先级最高)· off(传统阈值模式)。
  • 🎛️ 压缩决策优先级(高 → 低)—— 单请求 x-omniroute-compression 头部

路由组合覆盖规则 激活的命名配置文件 自适应/自动触发 面板默认值 关闭。最终生效的压缩方案会回显在响应头部的 X-OmniRoute-Compression: ; source= 字段中。

你可根据工作负载需求,选择基于 token 阈值自动触发、启用自适应旋钮、固定命名配置文件、设置单次请求特殊规则,或为路由组合分配专属流水线。平台提供可选的离线 评估套件(npm run eval:compression),可在固定语料库上评测压缩保真度与 token 节省率,验证通过后再上线变更。

📖 COMPRESSION_GUIDE.md · RTK_COMPRESSION.md · COMPRESSION_ENGINES.md

⚡ 快速开始

1) 安装并运行

npm install -g omniroute
omniroute

💡 遇到 npm warn ERESOLVE 或 peer 依赖警告?这类提示不影响使用。 使用 Gemini Web 或其他网页 Cookie 认证的服务商? npm 安装包已内置 Playwright,但未附带 Chromium 二进制文件。发起首个网页服务商请求前,请先参考 Playwright Chromium 配置说明。

控制台地址为 http://localhost:20128 · API 端点地址为 http://localhost:20128/v1。

2) 接入免费服务商(无需注册)

进入控制台 → Providers → 接入 Kiro AI(提供免费 Claude 额度,单账号每月约 50 次调用)或 OpenCode Free(无需认证)→ 配置完成。

3) 配置你的编码工具

Base URL: http://localhost:20128/v1
API Key: [从控制台 → Endpoints 页面复制]
Model: auto(零配置智能路由 — 也可指定任意服务商/模型)

4) 验证运行状态

curl http://localhost:20128/v1/models -H "Authorization: Bearer YOUR_KEY"

返回结果中应列出你已接入的所有模型。🎉 配置全部完成,你可以直接开始编码,OmniRoute 会自动为你执行路由与故障降级切换。

如果你的客户端无法发送自定义头部,OmniRoute 还提供了带令牌的兼容别名路径:

OpenAI 目录接口: http://localhost:20128/vscode/YOUR_KEY/
OpenAI 模型列表: http://localhost:20128/vscode/YOUR_KEY/models
OpenAI 对话接口: http://localhost:20128/vscode/YOUR_KEY/chat/completions
OpenAI 响应接口: http://localhost:20128/vscode/YOUR_KEY/responses
Ollama 对话接口: http://localhost:20128/vscode/YOUR_KEY/api/chat
Ollama 标签列表: http://localhost:20128/vscode/YOUR_KEY/api/tags

仅当客户端无法附加 Authorization: Bearer ... 头部时才可使用上述路径,头部认证仍是官方推荐的优先使用模式。

📦 更多安装方式 — Docker、源码、pnpm、Arch Linux

🐳 Docker

docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

:latest 标签对应已发布的最高稳定 SemVer 版本,不会追踪 git main 分支。GitOps 场景请固定使用 :X.Y.Z 精确版本标签。详见 Docker 发布通道说明。该镜像默认设置 OMNIROUTE_MEMORY_MB=1024,该内存配置足够支撑控制台与轻量对话场景。编码代理(来自 Claude Code、Codex、Grok 等客户端的 POST /v1/responses 请求)需要更大的 V8 堆内存,否则在处理两个重叠长上下文时会在约 12 GiB 内存占用处抛出进程 FATAL ERROR。容器内存配额需要大于堆内存大小(原生缓冲数据存储在 V8 堆外):

工作负载类型堆内存配置 (-e OMNIROUTE_MEMORY_MB)容器内存配额 (--memory)
控制台 / 轻量对话场景1024(镜像默认值)≥2 g
单编码代理运行8192≥10 g
两个并发长上下文 /v1/responses 请求10240–12288≥12–16 g
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-e OMNIROUTE_MEMORY_MB=8192 --memory=10g \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

完整参数表请参考 Docker 指南 — 编码代理运行内存配置。

[!NOTE] 预发布 Docker 通道:diegosouzapw/omniroute:next 与 diegosouzapw/omniroute:next-web 对应当前最新的 release/v* 分支代码。这类动态标签仅用于测试未发布的修复版本,不建议在生产环境中使用。详见 Docker 发布通道说明。

🥟 Bun

平台已适配 Bun 运行时检测,支持标准 bun install 与全局安装(bun install -g omniroute):

  • 内置 bun:sqlite 支持:OmniRoute 在 Bun 环境下会直接使用 Bun 内置的 bun:sqlite 驱动,在 Node.js 环境下回退使用 better-sqlite3,在其他环境下回退使用 sql.js。
  • 开发模式自动选择 Webpack:开发环境运行命令(bun run dev)会自动识别 Bun 环境并禁用 Turbopack,改用 Webpack 以避免原生 V8 绑定不兼容问题。生产构建命令(bun run build)完全遵循 OMNIROUTE_USE_TURBOPACK 环境变量配置,行为与 Node 环境完全一致:默认使用 Turbopack,设置 OMNIROUTE_USE_TURBOPACK=0 时使用 Webpack 构建(Dockerfile.bun 已将该变量暴露为构建参数)。
  • 专属 Bun Dockerfile:提供多阶段构建的 Dockerfile.bun 用于原生 Bun 生产部署(docker build -f Dockerfile.bun -t omniroute:bun .)。
# 使用 Bun 安装并运行
bun install
bun run dev

🛠️ 从源码构建

cp .env.example .env && npm install
PORT=20128 npm run dev

📦 pnpm

pnpm add -g omniroute@latest --allow-build=better-sqlite3 --allow-build=@swc/core && omniroute

🐧 Arch Linux(AUR 仓库)

yay -S omniroute-bin && systemctl --user enable --now omniroute.service

🔧 Nix(Flake 环境)

# 使用 Nix Flake 进入开发环境
nix develop
npm run dev

# 或使用 devbox 运行
devbox run npm run dev

📖 Docker 指南 — 包含 Compose 配置文件、Caddy HTTPS 配置、Cloudflare 隧道相关说明。

🦭 Podman 镜像名称:ghcr.io/diegosouzapw/omniroute 参考标签:latest

轩辕镜像配置手册

按平台快速找到配置文档

一键安装

一键安装 Docker

Linux Docker 一键安装

AI

用 AI 使用轩辕镜像

agents.md · AI 对话 · 提示词

Docker

登录仓库拉取

登录认证 · 私有仓库

专属域名拉取

免登录 · 高速拉取

Linux

Docker 镜像配置

Windows / Mac

Docker Desktop 配置

MacOS OrbStack

OrbStack 容器

Apple Container

macOS 原生容器

Docker Compose

Compose 项目配置

NAS

群晖

Synology 配置

飞牛

fnOS 镜像配置

绿联

绿联 NAS

威联通

QNAP 配置

极空间

极空间 NAS

Unraid

Unraid NAS

企业仓库

其他仓库

ghcr · Quay · nvcr

Harbor 镜像源

Proxy Repository 对接

Portainer 镜像源

Registries 配置

Nexus 镜像源

Docker Proxy 缓存

开发工具

Dev Containers

VS Code 开发容器

Podman

Podman 配置指南

Singularity / Apptainer

HPC 科学计算容器

Kubernetes

K8s Containerd

Kubernetes · Containerd

K3s

轻量级集群

面板 / 网络

爱快路由

爱快 4.0 · iKuai 镜像加速

宝塔面板

一键配置镜像源

需要其他帮助?请查看我们的 常见问题Docker 镜像访问常见问题解答 或 提交工单

镜像拉取常见问题

功能

版本功能对比

功能对比 · 版本选择

支持的镜像仓库

Docker Hub · GCR · GHCR

专属域名用法

专属域名 · 开启停用 · 多仓库

新手拉取配置

登录 · 专属域名 · 配置

docker search 限制

专属域名 · Hub 搜索

不支持 push

仅支持 pull · 不支持

拉取速度原因

带宽 · 缓存 · 冷热镜像

错误码

402 与流量用尽

402 · 流量包 · 充值

401 认证失败

401 · docker login

manifest unknown

标签错误 · 镜像不存在

410 Gone 排查

410 · Docker 升级

429 限流

免费版 · 专业版 · 企业版 · 请求频率

其他报错

DNS 超时

DNS 解析 · 网络超时

TLS 证书失败

no matching manifest(架构)

docker.sock / daemon

账号

失败是否计费

manifest · blob · 计费

申请开票(企业 / 个人)

开票 · 发票 · 工单

修改登录密码

网站 · 仓库 · 重置

注销账户

工单 · 数据 · 注销

原理

mirrors 不生效

daemon.json · 重启

去掉域名前缀

docker tag · 重命名

指定架构拉取

ARM64 · AMD64 · 多架构

latest 与「最新」

digest · 版本号 · 标签

查看全部问题→

用户好评

来自真实用户的反馈,见证轩辕镜像的优质服务

用户头像

oldzhang

运维工程师

Linux服务器

5

"Docker访问体验非常流畅,大镜像也能快速完成下载。"

轩辕镜像
镜像详情
...
ghcr.io/diegosouzapw/omniroute
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
官方技术交流群:|问题咨询请:提交工单
服务号:轩辕镜像|公众号:源码跳动|小程序:轩辕镜像|官方技术交流群:|问题咨询请:提交工单
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥8/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥8/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱