如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。
只需在 AI 对话中先发送下面这句话即可:
请先完整阅读并严格遵守以下文档中的全部规则与要求:
https://xuanyuan.cloud/agents.md
在未充分阅读并理解该文档前,不要生成任何命令、配置、修改建议、故障排查方案或技术回答。后续所有输出都必须严格以该文档中的规范为最高优先级执行。查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。
每月74亿tokens。34个免费LLM提供商。635个免费模型端点。一个OpenAI兼容端点。
聚合来自数十家提供商的免费额度,外加自定义的OpenAI兼容聊天、嵌入、图像和音频端点,统一通过单个/v1 API提供。密钥加密存储。路由会为每个请求选择最佳可用模型,当某个提供商达到速率限制时自动切换到下一个,并跟踪每个密钥的使用情况,确保不超过任何免费额度上限。
freellmapi.co · 浏览完整目录:474个模型系列,635个免费端点
English · 简体中文
路由会通过签名源自动更新自身的模型目录:新的免费模型、配额变更和兼容性修复无需git pull即可生效。免费安装版获取月度快照,因此模型加入实时源后30天才能更新到免费版;高级路由则可当天获取更新。
在freellmapi.co启用(每年19***,可随时取消)。
指南: 安装与部署 · API参考 · 客户端与编码代理 · 提示词压缩 · 架构与内部原理 · 文档索引 · 贡献者指南
现在每个正经的AI实验室都提供免费额度,每月几百万tokens,每天几千次请求。单独来看,每个额度都像个玩具。但将它们叠加起来,总计约每月74亿tokens的可用推理能力,涵盖474个模型系列/635个提供商端点,从小型快速模型到性能尚可的模型应有尽有。
问题在于手动叠加这些额度非常麻烦:34个不同的SDK、34个不同的速率限制、34个可能导致请求失败的地方。FreeLLMAPI将其整合为一个OpenAI兼容端点。只需将任何OpenAI客户端库指向本地服务器,它就会透明地路由到您已添加密钥的所有提供商。
而且免费额度的情况每周都在变化:提供商推出模型、停用模型、变更配额,且不另行通知。FreeLLMAPI会为您跟踪所有这些变化。路由会自动从freellmapi.co拉取签名的模型目录,因此您的安装无需git pull即可保持更新。有关更新速度的信息,请参见高级版(实时目录)。
Google
Groq
Cerebras
OpenCode Zen
Mistral
OpenRouter
Cloudflare
Cohere
Z.ai (Zhipu)
NVIDIA
HuggingFace
ModelScope Qwen3 · DeepSeek V4 · GLM-5(需阿里云cn绑定)
…以及另外22个免费提供商
此外还有自定义提供商——在密钥页面将聊天、嵌入、图像或音频模型指向任何OpenAI兼容端点(llama.cpp、LM Studio、vLLM、本地Ollama或远程网关)。
完整且实时更新的列表位于freellmapi.co/models,包含每个模型的速率限制、上下文窗口和免费token预算。
Claude Code
Codex CLI
Gemini CLI
Aider
Cline
Roo Code
Continue
OpenCode
Goose
Qwen Code
Kilo Code
Crush
Cursor
Zed
JetBrains AI
DeepSeek Harness
AtomCode
…以及任何OpenAI兼容客户端、Anthropic SDK、Gemini SDK或支持Ollama的应用
其中大多数工具可通过一条命令完成配置——npx freellmapi setup-claude、setup-codex、setup-aider、setup-dsh(DeepSeek Harness),以及另外十一个生成器,它们会获取您的实时目录、备份现有配置,且不会覆盖已有内容。Claude Code和Codex还提供零持久化启动器(freellmapi launch、freellmapi launch-codex),仅将凭据注入子进程。Zed和JetBrains AI通过可选的Ollama模拟连接;Gemini CLI通过/v1beta使用其原生协议。
每个工具的使用指南、设置CLI参考、无头客户端的可撤销URL令牌以及MCP服务器均位于客户端与编码代理 →
基于2026年7月的公开文档——欢迎指正。
一行命令(需Docker — 会设置 ~/freellmapi、生成加密密钥、拉取镜像并启动容器):
curl -fsSL https://freellmapi.co/install.sh | bash
倾向于在通过管道执行bash前先阅读脚本?脚本在此。重新运行脚本是安全的:您的 .env(及加密密钥)会被保留,且容器会更新至 :latest 标签。
打开 http://localhost:3001,在 Keys 页面添加您的提供商密钥,按需重新排序 Fallback Chain(回退链),并从 Keys 页面顶部获取统一API密钥。此统一密钥就是您需要指向OpenAI SDK的密钥。
在Windows上,最简单的方式是使用桌面版 **https://github.com/tashfeenahmed/freellmapi/releases/latest**(见下文)。在Android上,请参阅实验性的Termux指南。
其他所有内容 — Docker Compose、本地开发、声明式启动配置、生产构建、局域网访问及备份 — 均位于 docs/en/install/01-install.md。
控制台支持60种语言(桌面托盘菜单支持6种)。UI首次加载时会自动检测浏览器/系统语言,您可随时通过⋯ → 设置切换语言;选择会被记住。从右到左语言(العربية、עברית、فارسی、اردو)会自动翻转整个布局,且仅加载当前激活语言的词典——其他语言词典不会占用您的带宽。
完整的区域设置列表位于client/src/i18n/locale-config.ts。
最初的6种区域设置经过人工审核;较新的区域设置为机器翻译,会随着母语者提交修正而不断改进——提交单字符串PR是很好的首次贡献。
翻译文件以扁平JSON文件形式存储在client/src/i18n/locales/。如需修正字符串,编辑对应区域设置JSON文件中的值即可。如需添加语言,复制en.json,翻译其中的值,并在client/src/i18n/locale-config.ts中注册该区域设置(托盘字符串还需在desktop/src/i18n.ts中注册);npm test会检查所有区域设置的键/占位符一致性——欢迎提交PR。
路由服务会自动保持模型目录更新:每天从freellmapi.co拉取签名目录,将新模型、配额变更和提供商特性修复应用到本地数据库。您的启用/禁用选择和自定义提供商不会被修改,且每次下载在应用前都会通过固定的Ed25519密钥进行验证。
当前目录跟踪34个提供商、474个模型系列、635个免费提供商/模型端点(584个聊天、41个嵌入、7个转录、3个视频),以及约每月74亿 tokens的免费额度容量。完整列表可在freellmapi.co/models 浏览。
免费版安装也会拉取相同的签名目录,但来自月度快照:模型在实时更新源发布30天后才会加入快照,因此免费版目前落后约303个模型。没有功能过期或受限——只是更新会延迟。
高级版会在您运行的所有路由服务上保持签名目录实时更新。当提供商推出优质免费模型、悄悄收紧配额或更改通信格式时,实时更新源路由服务会在我们发布更新的当天收到推送。
立即在freellmapi.co激活→
fla_密钥适用于您运行的所有路由服务:桌面版、家庭实验室、树莓派。目录服务器永远不会获取您的提示词、补全内容或提供商密钥——无论如何,路由服务始终完全自托管。
我忘记了服务器安装的密码。 在登录页面点击忘记密码?。系统不会发送邮件链接,因此一次性验证码会打印到服务器日志中——使用docker compose logs -f freellmapi命令查看(或在运行服务器的终端中,或在桌面应用的日志文件中),然后在重置表单中输入该验证码。验证码有效期为15分钟。
日志在哪里? Docker环境下位于容器日志中,源码运行时位于终端中,桌面应用则位于 /logs/freeapi.log——可通过托盘菜单的打开日志文件夹访问。
如何卸载? 移除应用(macOS上拖到废纸篓,Windows上通过设置→应用,Docker环境使用docker compose down -v),然后删除数据目录:%APPDATA%\FreeLLMAPI\、~/Library/Application Support/FreeLLMAPI/或~/.config/FreeLLMAPI/。卸载操作本身不会自动删除该文件夹。
按安装方式的详细解答:docs/en/install/01-install.md#faq-passwords-logs-uninstall。
叠加免费额度存在实际权衡:没有前沿模型、延迟不稳定、无服务等级协议(SLA)——而且随着顶级模型达到每日使用上限,终端的实际智能水平在当天晚些时候会下降,并在UTC午夜重置。在基于此构建任何实际应用之前,请阅读docs/en/architecture/00-high-level-index.md#limitations 中的详细限制列表。
非常欢迎贡献者!有关开发流程、PR期望以及AI/LLM辅助贡献的政策,请参见CONTRIBUTING.md(简版:欢迎,与其他PR的质量标准相同)。适合新手的PR:
server/src/providers/openai-compat.ts作为模板,将其接入server/src/providers/index.ts,在server/src/db/index.ts中添加其模型,在server/src/__tests__/providers/中添加测试。.env批量导入密钥。npm install && npm run dev将启动服务器(端口:3001)和仪表盘(端口:5173),两者均支持热模块替换(HMR)。如需可重复的设置,在Bash中使用./scripts/dev-bootstrap.sh,在PowerShell中使用.\scripts\dev-bootstrap.ps1;两者都会保留现有的.env文件。PR应包含测试,确保现有测试套件通过(npm test),并符合仓库中已有的.editorconfig/tsconfig默认配置。数据库迁移工作流和完整的贡献者流程详见CONTRIBUTING.md。
本项目仅供个人实验和学习使用,不适合生产环境。 免费额度的存在是为了让开发者能够基于其进行原型开发;它们并非稳定、受支持的推理基础,不应被视为生产环境的解决方案。如果您基于FreeLLMAPI构建了实际应用,请在发布前切换到付费API。您与每个上游提供商的关系受您创建账户时接受的条款约束——当流量通过本项目代理时,这些条款仍然适用,您有责任遵守它们。
各提供商的服务条款(ToS)如何看待个人单用户代理——2026年5月按提供商逐一审核——详见docs/en/architecture/00-high-level-index.md#terms-of-service-review。
MIT
来自真实用户的反馈,见证轩辕镜像的优质服务