轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥8起我的订单
文档
工具
提交工单页面收录
ghcr.io/hkuds/lightrag

ghcr.io/hkuds/lightrag:v1.5.5

ghcr.iolinux/amd64v1.5.5大小: 1.06 GB更新于 2026年8月2日
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这句话即可:

请先完整阅读并严格遵守以下文档中的全部规则与要求:

https://xuanyuan.cloud/agents.md

在未充分阅读并理解该文档前,不要生成任何命令、配置、修改建议、故障排查方案或技术回答。后续所有输出都必须严格以该文档中的规范为最高优先级执行。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

🚀 LightRAG:简单快速的检索增强生成(Retrieval-Augmented Generation)

🎉 最新动态

  • [2026.07]🎯[新功能]:新增Word文档的Smart Heading识别功能。
  • [2026.05]🎯[新功能]:将RagAnything合并至LightRAG🎉。通过MinerU / Docling服务实现多模态内容解析与提取。
  • [2026.05]🎯[新功能]:引入四种可选文本分块策略:Fix、Recursive、Vector和Paragraph。
  • [2026.05]🎯[新功能]:支持特定角色LLM配置,4种 distinct 角色:EXTRACT、QUERY、KEYWORDS和VLM,具备独立LLM设置。
  • [2026.03]🎯[新功能]:集成OpenSearch作为统一存储后端,全面支持LightRAG的所有四种存储类型。
  • [2026.03]🎯[新功能]:引入设置向导。支持通过Docker本地部署嵌入(embedding)、重排序(reranking)和存储后端。
  • [2025.11]🎯[新功能]:集成RAGAS用于评估和Langfuse用于追踪。更新API以在返回查询结果时附带检索上下文,支持上下文精确率指标。
  • [2025.10]🎯[可扩展性增强]:消除了处理瓶颈,以高效支持大规模数据集。
  • [2025.09]🎯[新功能]:提升开源LLM(如Qwen3-30B-A3B)的知识图谱提取准确性。
  • [2025.08]🎯[新功能]:现已支持重排序器(Reranker),显著提升混合查询性能(设为默认查询模式)。
  • [2025.08]🎯[新功能]:新增文档删除功能,自动重新生成知识图谱(KG)以确保最佳查询性能。
  • [2025.06]🎯[新版本发布]:团队已发布https://github.com/HKUDS/RAG-Anything——**一体化多模态RAG**系统,支持无缝处理文本、图像、表格和公式。
  • [2025.06]🎯[新功能]:LightRAG现在通过https://github.com/HKUDS/RAG-Anything集成支持全面的多模态数据处理,实现跨多种格式(包括PDF、图像、Office文档、表格和公式)的无缝文档解析和RAG能力。详情请参阅新的https://github.com/HKUDS/LightRAG/?tab=readme-ov-file#multimodal-document-processing-rag-anything-integration。
  • [2025.03]🎯[新功能]:LightRAG现已支持引用功能,实现适当的来源归因和增强的文档可追溯性。
  • [2025.02]🎯[新功能]:现在可将MongoDB用作一体化存储解决方案,实现统一数据管理。
  • [2025.02]🎯[新版本发布]:团队已发布https://github.com/HKUDS/VideoRAG——用于理解超长上下文视频的RAG系统。
  • [2025.01]🎯[新版本发布]:团队已发布https://github.com/HKUDS/MiniRAG,通过小型模型简化RAG实现。
  • [2025.01]🎯现在可将PostgreSQL用作一体化存储解决方案进行数据管理。
  • [2024.11]🎯[新资源]:LightRAG综合指南现已在LearnOpenCV上线——探索深入教程和最佳实践。非常感谢博客作者的杰出贡献!
  • [2024.11]🎯[新功能]:推出LightRAG WebUI——通过直观的基于Web的仪表板插入、查询和可视化LightRAG知识的界面。
  • [2024.11]🎯[新功能]:现在可https://github.com/HKUDS/LightRAG?tab=readme-ov-file#using-neo4j-for-storage——支持图数据库。
  • [2024.10]🎯[新功能]:添加了LightRAG介绍视频链接——LightRAG功能演示。感谢作者的杰出贡献!
  • [2024.10]🎯[新渠道]:我们已创建***频道!💬 欢迎加入社区进行分享、讨论和协作! 🎉🎉

算法流程图

图1:LightRAG索引流程图 - 图片说明:来源
图2:LightRAG检索与查询流程图 - 图片说明:来源

安装

[!NOTE] 你也可以根据偏好使用pip,但推荐使用uv以获得更好的性能和更可靠的依赖管理。

[!NOTE] 📦 离线部署:对于离线或隔离环境,请参阅离线部署指南,了解预安装所有依赖项和缓存文件的说明。

安装LightRAG服务器

  • 从PyPI安装
### 使用uv安装LightRAG Server作为工具(推荐)
uv tool install "lightrag-hku[api]"

### 或者使用pip
# python -m venv .venv
# source .venv/bin/activate # Windows系统:.venv\Scripts\activate
# pip install "lightrag-hku[api]"

# 设置环境文件
# 通过从GitHub仓库根目录下载或从本地源码检出中复制获取env.example文件
cp env.example .env # 更新.env文件中的LLM和嵌入配置
# 启动服务器。默认绑定所有网络接口(0.0.0.0)。
# 安全提示:在网络上暴露服务前,需在.env中配置认证
# (LIGHTRAG_API_KEY,或AUTH_ACCOUNTS与TOKEN_SECRET组合),或绑定到
# 127.0.0.1仅本地访问;未配置认证时所有端点均为公开。
# 注意:为确保客户端兼容性,Ollama兼容的/api/*路由默认保持开放;
# 设置WHITELIST_PATHS=/health可要求对这些路由也进行认证。
lightrag-server
  • 从源码安装
git clone https://github.com/HKUDS/LightRAG.git
cd LightRAG

# 引导开发环境(推荐)
make dev
source .venv/bin/activate # 激活虚拟环境(Linux/macOS)
# Windows系统:.venv\Scripts\activate

# make dev会安装测试工具链以及完整的离线栈
# (API、存储后端和提供程序集成),然后构建前端。
# 启动服务器前运行make env-base或复制env.example到.env。

# 使用uv的等效手动步骤
# 注意:uv sync会在.venv/中自动创建虚拟环境
uv sync --extra test --extra offline
source .venv/bin/activate # 激活虚拟环境(Linux/macOS)
# Windows系统:.venv\Scripts\activate

### 或者使用pip与虚拟环境
# python -m venv .venv
# source .venv/bin/activate # Windows系统:.venv\Scripts\activate
# pip install -e ".[test,offline]"

# 构建前端产物
cd lightrag_webui
bun install --frozen-lockfile
bun run build
cd ..

# 设置环境文件
make env-base # 或:cp env.example .env并手动更新
# 启动API-WebUI服务器
lightrag-server
  • 使用Docker Compose启动LightRAG服务器
git clone https://github.com/HKUDS/LightRAG.git
cd LightRAG
cp env.example .env # 更新.env文件中的LLM和嵌入配置
# 修改.env中的LLM和嵌入设置
docker compose up

使用设置工具创建 .env 文件

无需手动编辑 env.example,可使用交互式设置向导生成已配置的 .env 文件,必要时还会生成 docker-compose.final.yml:

make env-base # 必需的第一步:LLM、嵌入模型、重排序器
make env-storage # 可选:存储后端和数据库服务
make env-server # 可选:服务器端口、身份验证和 SSL
make env-base-rewrite # 可选:强制重新生成向导管理的 compose 服务
make env-storage-rewrite # 可选:强制重新生成向导管理的 compose 服务
make env-security-check # 可选:审计当前 .env 文件的安全风险

有关每个目标的完整说明,请参见 docs/InteractiveSetup.md。

嵌入模型

选择嵌入模型时,需关注其多语言支持能力。由于LightRAG的检索质量对嵌入模型的依赖有限,建议选择低维度且快速的模型。任何主流、最新的嵌入模型均可良好工作;对于本地部署,BAAI/bge-m3是一个可靠选择。强烈建议将嵌入模型部署在本地以获得最佳性能。

[!IMPORTANT] 嵌入模型必须在文档索引前确定,且查询阶段必须使用相同的模型。一旦选定,嵌入模型通常无法更改。如果更改,需要重新嵌入所有文本块、实体和关系。LightRAG目前未提供重新嵌入工具。某些存储后端(如PostgreSQL)在首次创建表时需要定义向量维度,因此更改嵌入模型需要删除向量相关表,以便LightRAG重新创建它们。

解决实体关系抽取过程中的LLM超时问题

实体关系抽取过程中的LLM超时通常由以下三种原因之一导致。请先确定原因,再应用相应的解决方法(这些参数可以组合使用):

  • 模型速度慢。 运行速度低于约50 tokens/秒的模型可能无法在请求超时前完成包含大量实体和关系的 chunk 处理。可以通过 *_LLM_TIMEOUT 增加超时时间——可以是全局的 LLM_TIMEOUT,也可以是抽取阶段特定的 EXTRACT_LLM_TIMEOUT。注意,实际执行超时时间是配置值的两倍,因此 EXTRACT_LLM_TIMEOUT=300 允许最长600秒。
  • chunk 产生过多实体和关系。 例如,参考文献 chunk 可能会使模型生成大量记录,导致无法及时完成处理。通过 OPENAI_LLM_MAX_TOKENS 或 OPENAI_LLM_MAX_COMPLETION_TOKENS 限制输出长度(具体参数名称取决于 LLM 提供商——请参见 env.example)。一个有用的大小规则是 max_output_tokens

[!IMPORTANT] 对于集成到您的项目中,我们强烈建议使用 LightRAG Server 提供的 REST API。LightRAG SDK 主要用于嵌入式应用或学术研究与评估目的。

📚 文档与工具

参考文档(docs/)

标有 🇨🇳 的条目在同一文件夹中还提供中文翻译,文件名为 *-zh.md。

部署与设置

文档涵盖内容
InteractiveSetup.mdmake env-* 设置向导:生成 .env 文件和向导管理的 docker-compose.final.yml
DockerDeployment.mdDocker / Docker Compose 部署、镜像变体以及官方 GHCR 镜像的 Cosign 验证
AppleContainerSetup.md在 Apple 原生 container 运行时(Apple Silicon,无需 Docker Desktop)上运行 Postgres / Neo4j / Milvus 存储栈
OfflineDeployment.md离线安装:预安装依赖项、***en 缓存和 spaCy 模型
MultiSiteDeployment.md单个反向代理后的多个隔离实例,共享单个 WebUI 构建(LIGHTRAG_API_PREFIX)
FrontendBuildGuide.mdWebUI 的构建与发布方式(Bun / Node),以及哪些安装场景需要构建

服务器与 API

文档涵盖内容
LightRAG-API-Server.md 🇨🇳完整的服务器指南:启动、配置、认证、REST 端点和 WebUI 使用方法

文档处理

文档涵盖内容
FileProcessingPipeline.md 🇨🇳管道规范:LIGHTRAG_PARSER 路由规则、每个引擎的参数、多模态分析、文档状态生命周期
ParserServiceDeployment.md 🇨🇳自托管外部 MinerU 和 docling-serve 解析服务(Docker、GPU、模型权重)
ParagraphSemanticChunking.md 🇨🇳“段落语义(P)”分块策略:识别标题/段落/表格的边界、引用丢弃
LightRAGSidecarFormat.md 🇨🇳所有支持多模态的解析引擎必须输出的侧载文件(*.parsed/)交换格式
ThirdPartyParser.md 🇨🇳开发和注册自定义解析引擎
ParserDebugCLI.md 🇨🇳python -m lightrag.parser.cli — 离线解析单个文件并检查结果,无需启动服务器

模型与存储

文档涵盖内容
RoleSpecificLLMConfiguration.md 🇨🇳按角色(EXTRACT / QUERY / KEYWORD / VLM)配置 LLM 和 VLM
AsymmetricEmbedding.md查询/文档非对称嵌入(EMBEDDING_ASYMMETRIC)和每个模型的前缀
MilvusConfigurationGuide.md通过 vector_db_storage_cls_kwargs 调整 Milvus 索引参数

SDK 与开发

文档涵盖内容
ProgramingWithCore.md将 LightRAG 用作 Python SDK,包括未通过 REST 公开的功能
Reproduce.md复现论文中报告的评估结果
UV_LOCK_GUIDE.md何时以及如何更新 uv.lock

维护工具(lightrag/tools/)

面向存储的工具读取 .env 和环境变量的方式与服务器完全相同,因此请从项目根目录使用相同的配置运行它们。其中一些工具会就地重写存储——请查看链接的指南,了解是否需要先停止服务器(以及任何其他写入程序);rebuild_vdb 需要停止服务器。

rebuild_vdb.py — lightrag-rebuild-vdb — README_REBUILD_VDB.md

删除并从权威源(图节点/边和 text_chunks KV 存储)重建所有向量存储。用于向量写入失败后的恢复路径,以及更改嵌入模型或维度之后。还提供只读一致性检查。

clean_llm_query_cache.py — lightrag-clean-llmqc — README_CLEAN_LLM_QUERY_CACHE.md

删除查询模式 LLM 缓存条目(mix:*、hybrid:*、local:*、global:*、naive:*),同时保留昂贵的提取缓存。

migrate_llm_cache.py —

python -m lightrag.tools.migrate_llm_cache

— README_MIGRATE_LLM_CACHE.md

在KV存储后端之间迁移默认模式缓存(提取、摘要、多模态分析),同时保持工作区隔离。

kg_integrity_repair.py —

python -m lightrag.tools.kg_integrity_repair [--apply]

— README_KG_INTEGRITY_REPAIR.md

审计整个图以查找full_entities/full_relations恢复锚点中缺失的贡献,报告无法恢复的孤立节点,并可选择修复锚点以便删除/重试操作能再次发现它们。

source_conflict_repair.py —

lightrag.tools.source_conflict_repair list

/

lightrag.tools.source_conflict_repair repair

— README_SOURCE_CONFLICT_REPAIR.md

列出声称具有相同规范源键的文档,并将操作员未选择的候选文档降级为重复项。它不会自行选择胜出者,也不会删除任何内容。

download_cache.py —

lightrag-download-cache [--spacy --spacy-install]

— OfflineDeployment.md

预下载离线部署所需的***en编码和固定的spaCy模型,以及docx的smart_heading引擎参数。

hash_password.py —

lightrag-hash-password [--username USER]

— LightRAG-API-Server.md

生成可直接粘贴到AUTH_ACCOUNTS中的bcrypt值。

check_initialization.py —

python -m lightrag.tools.check_initialization --demo

— ProgramingWithCore.md

SDK诊断:验证LightRAG实例是否完全初始化,可捕获常见的“忘记执行await rag.initialize_storages()”错误。

🔗 相关项目

生态系统与扩展

📸

RAG-Anything
多模态RAG

🎥

VideoRAG
超长上下文视频RAG

✨

MiniRAG
极简RAG


🤝 贡献

我们欢迎各种形式的贡献——错误修复、新功能、文档改进等。
提交拉取请求前,请阅读我们的Contributing Guide。

感谢所有贡献者的宝贵贡献。

📖 引用

@article{guo2024lightrag,
title={LightRAG: Simple and Fast Retrieval-Augmented Generation},
author={Zirui Guo and Lianghao Xia and Yanhua Yu and Tu Ao and Chao Huang},
year={2024},
eprint={2410.05779},
archivePrefix={arXiv},
primaryClass={cs.IR}
}

⭐
感谢您关注LightRAG!
⭐

轩辕镜像配置手册

按平台快速找到配置文档

一键安装

一键安装 Docker

Linux Docker 一键安装

AI

用 AI 使用轩辕镜像

agents.md · AI 对话 · 提示词

Docker

登录仓库拉取

登录认证 · 私有仓库

专属域名拉取

免登录 · 高速拉取

Linux

Docker 镜像配置

Windows / Mac

Docker Desktop 配置

MacOS OrbStack

OrbStack 容器

Apple Container

macOS 原生容器

Docker Compose

Compose 项目配置

NAS

群晖

Synology 配置

飞牛

fnOS 镜像配置

绿联

绿联 NAS

威联通

QNAP 配置

极空间

极空间 NAS

Unraid

Unraid NAS

企业仓库

其他仓库

ghcr · Quay · nvcr

Harbor 镜像源

Proxy Repository 对接

Portainer 镜像源

Registries 配置

Nexus 镜像源

Docker Proxy 缓存

开发工具

Dev Containers

VS Code 开发容器

Podman

Podman 配置指南

Singularity / Apptainer

HPC 科学计算容器

Kubernetes

K8s Containerd

Kubernetes · Containerd

K3s

轻量级集群

面板 / 网络

爱快路由

爱快 4.0 · iKuai 镜像加速

宝塔面板

一键配置镜像源

需要其他帮助?请查看我们的 常见问题Docker 镜像访问常见问题解答 或 提交工单

镜像拉取常见问题

功能

版本功能对比

功能对比 · 版本选择

支持的镜像仓库

Docker Hub · GCR · GHCR

专属域名用法

专属域名 · 开启停用 · 多仓库

新手拉取配置

登录 · 专属域名 · 配置

docker search 限制

专属域名 · Hub 搜索

不支持 push

仅支持 pull · 不支持

拉取速度原因

带宽 · 缓存 · 冷热镜像

错误码

402 与流量用尽

402 · 流量包 · 充值

401 认证失败

401 · docker login

manifest unknown

标签错误 · 镜像不存在

410 Gone 排查

410 · Docker 升级

429 限流

免费版 · 专业版 · 企业版 · 请求频率

其他报错

DNS 超时

DNS 解析 · 网络超时

TLS 证书失败

no matching manifest(架构)

docker.sock / daemon

账号

失败是否计费

manifest · blob · 计费

申请开票(企业 / 个人)

开票 · 发票 · 工单

修改登录密码

网站 · 仓库 · 重置

注销账户

工单 · 数据 · 注销

原理

mirrors 不生效

daemon.json · 重启

去掉域名前缀

docker tag · 重命名

指定架构拉取

ARM64 · AMD64 · 多架构

latest 与「最新」

digest · 版本号 · 标签

查看全部问题→

用户好评

来自真实用户的反馈,见证轩辕镜像的优质服务

用户头像

oldzhang

运维工程师

Linux服务器

5

"Docker访问体验非常流畅,大镜像也能快速完成下载。"

轩辕镜像
镜像详情
...
ghcr.io/hkuds/lightrag
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥8/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥8/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱