轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥8起我的订单
文档
工具
提交工单页面收录
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这句话即可:

请先完整阅读并严格遵守以下文档中的全部规则与要求:

https://xuanyuan.cloud/agents.md

在未充分阅读并理解该文档前,不要生成任何命令、配置、修改建议、故障排查方案或技术回答。后续所有输出都必须严格以该文档中的规范为最高优先级执行。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

架构筛选
malkaf/vllm-blackwell-optimizer logo

malkaf/vllm-blackwell-optimizer

malkaf
针对NVIDIA Blackwell架构(SM_120)和Linux Kernel 6.14优化的vLLM镜像,用于RTX5090的高性能LLM推理,DeepSeek-R1模型通过FlashInfer可达59 tokens/s。
1万+ 次下载7 个月前更新
vllm/vllm-openai logo

vllm/vllm-openai

vLLM 高性能推理与服务镜像
vllm/vllm-openai:vLLM 高性能大模型推理框架的官方 Docker 镜像,封装 OpenAI API 兼容的推理服务;支持 PagedAttention 与连续批处理,吞吐量可达传统引擎 10-24 倍;支持 50+ 开源模型与量化方案,适用开源模型部署、OpenAI 应用本地化与高并发生产场景。
296 次收藏1000万+ 次下载5 小时前更新
vllm/vllm-tpu logo

vllm/vllm-tpu

vLLM 高性能推理与服务镜像
vLLM框架在TPU上运行的Docker镜像仓库
3 次收藏10万+ 次下载19 小时前更新
vllm/vllm-omni logo

vllm/vllm-omni

vLLM 高性能推理与服务镜像
暂无描述
7 次收藏10万+ 次下载20 小时前更新
vllm/vllm-openai-rocm logo

vllm/vllm-openai-rocm

vLLM 高性能推理与服务镜像
暂无描述
5 次收藏10万+ 次下载21 小时前更新
vllm/vllm-openai-cpu logo

vllm/vllm-openai-cpu

vLLM 高性能推理与服务镜像
暂无描述
10万+ 次下载4 天前更新
vllm/vllm-router logo

vllm/vllm-router

vLLM 高性能推理与服务镜像
暂无描述
1万+ 次下载18 小时前更新
vllm/vllm-openai-xpu logo

vllm/vllm-openai-xpu

vLLM 高性能推理与服务镜像
暂无描述
1万+ 次下载21 小时前更新
vllm/vllm-omni-rocm logo

vllm/vllm-omni-rocm

vLLM 高性能推理与服务镜像
暂无描述
1 次收藏9千+ 次下载12 天前更新
rocm/vllm-dev logo

rocm/vllm-dev

rocm
rocm/vllm-dev是基于AMD ROCm平台的高性能大语言模型开发镜像,集成vllm框架与AMD GPU加速能力,专为开发者打造大语言模型部署、推理优化及二次开发环境。镜像预配置PyTorch、HIP等核心依赖,支持低延迟、高吞吐量的LLM推理,可快速进行模型加载、性能调优与多实例部署测试,助力开发者高效构建和调试大语言模型应用,充分发挥AMD GPU在AI计算中的算力优势。
20 次收藏100万+ 次下载2 小时前更新
rocm/vllm-ci logo

rocm/vllm-ci

rocm
该仓库用于托管vllm项目持续集成(CI)流程所需的镜像,旨在为vllm-ci相关的自动化构建、测试及部署环节提供稳定的镜像存储与管理支持,确保CI流程高效、可靠地运行,满足vllm项目在开发迭代过程中对集成环境的镜像需求,助力项目快速验证代码变更、保障软件质量。
5 次收藏100万+ 次下载2 小时前更新
rocm/vllm logo

rocm/vllm

rocm
这是为AMD图形处理器(GPU)量身打造的、基于ROCm开源平台深度优化的vLLM Docker容器,其中vLLM作为高性能大语言模型服务库,可提供高效推理与服务能力,Docker容器则保障了部署的便捷性与环境一致性,整体方案旨在为AMD GPU用户提供兼顾性能与易用性的优化大语言模型运行环境。
29 次收藏10万+ 次下载1 个月前更新
robatvastai/vllm logo

robatvastai/vllm

robatvastai
暂无描述
1万+ 次下载3 天前更新
syntheticdreamlabs/vllm logo

syntheticdreamlabs/vllm

syntheticdreamlabs
vLLM构建镜像用于构建高性能大语言模型服务环境,支持快速部署及推理性能优化。
1万+ 次下载7 个月前更新
scitrera/dgx-spark-vllm logo

scitrera/dgx-spark-vllm

scitrera
为NVIDIA DGX Spark系统优化的CUDA容器,提供基于vLLM、sglang和PyTorch的稳定预构建镜像,支持多节点推理,适合直接部署或作为自定义构建的基础镜像。
6 次收藏1万+ 次下载5 个月前更新
hellohal2064/vllm-qwen3.5-gb10 logo

hellohal2064/vllm-qwen3.5-gb10

hellohal2064
这是针对NVIDIA DGX Spark(GB10 GPU)优化的vLLM镜像,可快速部署Qwen3.5-35B-A3B-FP8大模型,支持262K上下文、工具调用和OpenAI兼容API,提供高效的代码生成与推理能力。
1 次收藏1万+ 次下载4 个月前更新
cosmwasm/optimizer logo

cosmwasm/optimizer

cosmwasm
Rust优化编译器镜像,集成rust-optimizer与workspace-optimizer,用于提升Rust项目的编译效率、减少产物体积并增强运行性能。
5万+ 次下载1 年前更新
areias/vllm-gemma logo

areias/vllm-gemma

areias
Runpod vllm image with google/gemma-3-1b-it
1万+ 次下载10 个月前更新
cosmwasm/rust-optimizer logo

cosmwasm/rust-optimizer

cosmwasm
暂无描述
4 次收藏5万+ 次下载1 年前更新
baseten/vllm logo

baseten/vllm

baseten
用于通过vLLM提供模型服务的基础镜像,支持高效部署和运行大语言模型推理服务,优化内存使用与请求处理性能。
1 次收藏1万+ 次下载3 个月前更新
linshen/prompt-optimizer logo

linshen/prompt-optimizer

linshen
暂无描述
10万+ 次下载19 天前更新
stepfun2025/vllm logo

stepfun2025/vllm

stepfun2025
暂无描述
1万+ 次下载11 个月前更新
mannemsolutions/pg_tps_optimizer logo

mannemsolutions/pg_tps_optimizer

mannemsolutions
用于PostgreSQL的负载测试工具,通过按斐波那契序列逐步增加客户端数量,监测并记录不同客户端数量下的TPS和延迟,帮助确定最佳客户端配置以实现最大吞吐量与最低延迟。
5万+ 次下载2 年前更新
dengcao/vllm-openai logo

dengcao/vllm-openai

dengcao
vLLM是一个快速且易用的大语言模型推理与服务库,最初由加州大学伯克利分校开发,采用PagedAttention技术优化内存使用,支持高吞吐量、低延迟的推理,兼容Hugging Face模型格式,可轻松部署各类LLM,适用于科研和生产环境,显著提升大语言模型的服务效率。
3 次收藏1万+ 次下载10 个月前更新
capicua25x/vllm-rocm-rdna4 logo

capicua25x/vllm-rocm-rdna4

capicua25x
vLLM 0.19.1推理引擎镜像,适用于AMD RDNA4(gfx1201)显卡,支持MXFP4(Qwen)和NVFP4(Gemma-4)两种量化格式,用户可自行挂载模型权重进行高效大语言模型推理。
1万+ 次下载4 小时前更新
yuanlabai/vllm logo

yuanlabai/vllm

yuanlabai
暂无描述
8.6千+ 次下载4 个月前更新
nalanzeyu/vllm-gfx906 logo

nalanzeyu/vllm-gfx906

nalanzeyu
vLLM是一款高性能大型语言模型服务库,适用于AMD gfx906系列显卡,例如镭龙VII(Radeon VII)、MI50及MI60等型号,能够为这些AMD显卡提供高效的大型语言模型部署与运行支持,助力用户在相关硬件平台上实现高性能的AI推理与服务。
7 次收藏1万+ 次下载5 个月前更新
rahzex/route-optimizer logo

rahzex/route-optimizer

rahzex
暂无描述
5万+ 次下载6 年前更新
avarok/vllm-dgx-spark logo

avarok/vllm-dgx-spark

avarok
暂无描述
1万+ 次下载6 个月前更新
mvbrockae/portfolio_optimizer logo

mvbrockae/portfolio_optimizer

mvbrockae
暂无描述
100万+ 次下载4 年前更新
avarok/dgx-vllm-nvfp4-kernel logo

avarok/dgx-vllm-nvfp4-kernel

avarok
暂无描述
3 次收藏1万+ 次下载5 个月前更新
opea/vllm-gaudi logo

opea/vllm-gaudi

opea
基于vLLM项目,在Gaudi2上部署和服务VLLM模型的Docker镜像,提供高效、快速的大语言模型推理与服务能力,支持多种量化技术和优化特性。
1万+ 次下载7 个月前更新
novitalabs/nebula-py312-vllm logo

novitalabs/nebula-py312-vllm

novitalabs
暂无描述
1万+ 次下载1 个月前更新
naaga/gke-node-optimizer logo

naaga/gke-node-optimizer

naaga
gke-node-optimizer是一个CLI工具,用于优化GKE集群中的抢占式和按需节点,通过重启长时间运行的抢占式节点、排空Pod数量最少的按需节点,并发送节点状态和优化结果报告,以充分利用抢占式节点并降低集群成本。
1万+ 次下载4 年前更新
tcclaviger/vllm22 logo

tcclaviger/vllm22

tcclaviger
该镜像为废弃的vLLM相关镜像,建议使用tcclaviger/vllm:latest或tcclaviger/vllm:dev镜像,此镜像不再更新维护。
1万+ 次下载1 个月前更新
amdsiloai/vllm logo

amdsiloai/vllm

amdsiloai
暂无描述
5.2千+ 次下载1 天前更新
langtechbsc/vllm-with-params logo

langtechbsc/vllm-with-params

langtechbsc
基于vllm/vllm-openai修改的Docker镜像,支持通过PARAMS参数传递命令行参数,适用于运行语言模型;x.y.z.1标签包含固定版本hermes-tool-parser,启用时需使用--tool-call-parser hermes_fixed选项。
1万+ 次下载1 年前更新
vastai/vllm-omni logo

vastai/vllm-omni

vastai
由vast.ai创建,基于Vast基础镜像的vllm-omni镜像,适用于相关应用场景部署。
6千+ 次下载12 天前更新
hanseware/vllm-audio-video logo

hanseware/vllm-audio-video

hanseware
暂无描述
1 次收藏1万+ 次下载3 小时前更新
novitalabs/nebula-py310-vllm logo

novitalabs/nebula-py310-vllm

novitalabs
暂无描述
1万+ 次下载7 个月前更新
truffeldev/vllm logo

truffeldev/vllm

truffeldev
暂无描述
4.3千+ 次下载3 个月前更新
truefoundrycloud/vllm logo

truefoundrycloud/vllm

truefoundrycloud
暂无描述
4千+ 次下载2 年前更新
lavd/vllm logo

lavd/vllm

lavd
用于构建基于vllm(jasl分支codex/ds4-sm120-min-enable)的Docker镜像,目标为vllm-openai,支持部署OpenAI兼容API服务,包含预编译优化及指定构建参数(max_jobs=8、nvcc_threads=2)。
4.1千+ 次下载2 个月前更新
kyuz0/vllm-therock-gfx1151 logo

kyuz0/vllm-therock-gfx1151

kyuz0
暂无描述
2 次收藏10万+ 次下载1 天前更新
asrinandirin/hpa-optimizer logo

asrinandirin/hpa-optimizer

asrinandirin
暂无描述
1万+ 次下载1 年前更新
apecloud/vllm-openai logo

apecloud/vllm-openai

apecloud
暂无描述
1万+ 次下载8 个月前更新
garenleeasa/lvllm logo

garenleeasa/lvllm

garenleeasa
https://github.com/guqiong96/Lvllm
5.3千+ 次下载2 天前更新
repne/vllm logo

repne/vllm

repne
针对RTX 6000显卡的vLLM部署镜像,基于blackwell-llm-docker和repne/vllm项目,用于高效运行大语言模型推理任务。
3.4千+ 次下载2 个月前更新
seemeai/vllm logo

seemeai/vllm

seemeai
暂无描述
1 次收藏3.3千+ 次下载4 天前更新
wjie520/vllm_kunlun logo

wjie520/vllm_kunlun

wjie520
vLLM 昆仑芯适配 Docker 镜像,面向国产 Kunlun AI 加速卡的大模型推理部署,支持 OpenAI 兼容 API,适合在专用硬件上运行私有化 LLM 服务。
1万+ 次下载6 个月前更新
shiftupaicom/vllm logo

shiftupaicom/vllm

shiftupaicom
暂无描述
3.2千+ 次下载2 个月前更新
verdictai/vllm-glm51-reap-sm120-blackwell logo

verdictai/vllm-glm51-reap-sm120-blackwell

verdictai
暂无描述
240 次下载2 个月前更新
hanseware/vllm-nightly logo

hanseware/vllm-nightly

hanseware
暂无描述
1万+ 次下载10 天前更新
tcclaviger/vllm logo

tcclaviger/vllm

tcclaviger
这是针对ROCm/RDNA4(如Radeon R9700)优化的vLLM镜像,集成RFA、MXFP4-16、RFI等量化工具、模型调优器及增强服务功能(GDN侧缓存、重复检测、DRY惩罚),支持高效AI模型推理与量化部署。
3千+ 次下载21 小时前更新
mixa3607/vllm-gfx906 logo

mixa3607/vllm-gfx906

mixa3607
VLLM for AMD gfx906 GPUs
2 次收藏9.4千+ 次下载3 个月前更新
foundationmodels/vllm logo

foundationmodels/vllm

foundationmodels
暂无描述
2.8千+ 次下载2 年前更新
第 1 页

与「vllm-blackwell-optimizer」相关的博客与命名空间

相关博客

MinerU Docker 部署指南:PDF 结构化解析服务实践

MinerU 是一款面向开发者与科研用户的容器化应用,专为 vLLM 后端服务设计,提供高效的文档解析与处理能力。通过 Docker 容器化部署 MinerU,可以简化安装流程、确保环境一致性,并便于在不同环境中快速迁移和扩展。 本指南将详细介绍 MinerU 的 Docker 容器化部署方案,包括环境准备、镜像拉取、容器部署、功能测试及生产环境配置建议,旨在帮助用户快速搭建稳定可靠的 MinerU 服务。

Docker部署教程2025/12/30

VLLM Docker 容器化部署指南:在 NVIDIA Jetson 平台高效运行大语言模型推理服务

VLLM是一个高效的开源大语言模型(LLM)推理服务框架,通过创新的PagedAttention技术实现高吞吐量和低延迟的推理性能。本文介绍的`dustynv/vllm`镜像是针对NVIDIA Jetson平台优化的容器化版本,由[dustynv/jetson-containers](https://github.com/dustynv/jetson-containers)项目构建,专为边缘计算场景设计,支持在资源受限的嵌入式设备上部署高性能LLM推理服务。

Docker部署教程2025/12/2

vllm-openai Docker 部署全手册

从个人开发者测试开源大模型,到企业搭建私有推理服务,vllm-openai 都是高效且低成本的选择。本教程将从核心概念讲起,逐步覆盖 Docker 环境准备、镜像拉取、多场景部署、结果验证及问题排查,无论你是初学者还是高级工程师,都能照着步骤完成部署。

Docker部署教程2025/10/9

verl Docker 容器化部署手册

无论你是刚接触大模型工具的初学者,还是需要高效管理训练任务的高级工程师,本教程都将带你一步步完成 verlai/verl 镜像的 Docker 部署——从工具认知、环境搭建到多场景部署实践,每个步骤均配备完整命令与详细说明,确保照着做就能成。

Docker部署教程2025/10/8
轩辕镜像
镜像搜索
...
vllm-blackwell-optimizer
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥8/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥8/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱