轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥8起我的订单
文档
工具
提交工单页面收录
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这段话即可:

请先阅读并遵守:https://xuanyuan.cloud/agents.md

未读文档前不要生成 pull 命令或排错方案。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

架构筛选
openeuler/vllm-cpu logo

openeuler/vllm-cpu

openeuler
官方vLLM Ascend Docker镜像,基于openEuler构建,提供快速高效的LLM推理和服务能力,支持PagedAttention内存管理、连续批处理、多种量化技术及优化内核,适用于高性能语言模型部署。
5 次收藏5万+ 次下载2 个月前更新
mekayelanik/vllm-cpu logo

mekayelanik/vllm-cpu

mekayelanik
vLLM CPU推理引擎 - 为Intel/AMD/ARM64处理器优化的Docker镜像,提供高效的大语言模型服务,支持OpenAI兼容API及多种CPU指令集优化。
1 次收藏1万+ 次下载11 天前更新
ashahba/vllm-cpu logo

ashahba/vllm-cpu

ashahba
该仓库包含vLLM项目的CPU镜像,基于vLLM仓库中的Dockerfile.cpu构建。
1 次收藏3.3千+ 次下载7 个月前更新
openeulertest/vllm-cpu logo

openeulertest/vllm-cpu

openeulertest
暂无描述
2.8千+ 次下载3 天前更新
gabrielbico/vllm-cpu logo

gabrielbico/vllm-cpu

gabrielbico
多架构(amd64+arm64)Docker镜像,用于运行vLLM的CPU后端,自动从上游标签和提交构建,支持API服务器部署。
2千+ 次下载1 年前更新
konstantinvernermaif/vllm-cpu logo

konstantinvernermaif/vllm-cpu

konstantinvernermaif
暂无描述
1.7千+ 次下载1 年前更新
emericocto/vllm-cpu logo

emericocto/vllm-cpu

emericocto
Docker image for vllm using CPU
1.4千+ 次下载1 年前更新
syaffers/vllm-cpu logo

syaffers/vllm-cpu

syaffers
CPU build of vLLM on Mac M3 Pro
1.4千+ 次下载8 个月前更新
thecmrfrd/vllm-cpu logo

thecmrfrd/vllm-cpu

thecmrfrd
The vLLM project compiled for CPU
1.2千+ 次下载1 年前更新
inteldpo/vllm-cpu logo

inteldpo/vllm-cpu

inteldpo
暂无描述
1.2千+ 次下载1 年前更新
hsethuraman/vllm-cpu logo

hsethuraman/vllm-cpu

hsethuraman
暂无描述
1.1千+ 次下载6 个月前更新
ihiverlet/vllm-cpu logo

ihiverlet/vllm-cpu

ihiverlet
暂无描述
958 次下载1 年前更新
ydcho0902/vllm-cpu logo

ydcho0902/vllm-cpu

ydcho0902
vllm
887 次下载2 年前更新
ufcgibm/vllm-cpu logo

ufcgibm/vllm-cpu

ufcgibm
暂无描述
874 次下载4 个月前更新
mzammouri/vllm-cpu logo

mzammouri/vllm-cpu

mzammouri
暂无描述
839 次下载2 年前更新
outsoft/vllm-cpu logo

outsoft/vllm-cpu

outsoft
暂无描述
648 次下载1 年前更新
vllm/vllm-openai logo

vllm/vllm-openai

vLLM 高性能推理与服务镜像
vllm/vllm-openai:vLLM 高性能大模型推理框架的官方 Docker 镜像,封装 OpenAI API 兼容的推理服务;支持 PagedAttention 与连续批处理,吞吐量可达传统引擎 10-24 倍;支持 50+ 开源模型与量化方案,适用开源模型部署、OpenAI 应用本地化与高并发生产场景。
307 次收藏1000万+ 次下载2 天前更新
satendra/vllm-cpu logo

satendra/vllm-cpu

satendra
仅用于CPU环境的vLLM Docker镜像仓库,支持运行Hugging Face模型,提供便捷的模型部署和服务能力。
395 次下载1 年前更新
charmedkubeflow/vllm-cpu logo

charmedkubeflow/vllm-cpu

charmedkubeflow
暂无描述
384 次下载19 天前更新
zhawottj/vllm-cpu logo

zhawottj/vllm-cpu

zhawottj
暂无描述
339 次下载1 年前更新
phuongkhpt/vllm-cpu logo

phuongkhpt/vllm-cpu

phuongkhpt
暂无描述
332 次下载9 个月前更新
ceposta/vllm-cpu logo

ceposta/vllm-cpu

ceposta
暂无描述
318 次下载1 年前更新
amoyens1s/vllm-cpu logo

amoyens1s/vllm-cpu

amoyens1s
vllm-cpu
326 次下载1 年前更新
dorukbu/vllm-cpu logo

dorukbu/vllm-cpu

dorukbu
暂无描述
310 次下载1 年前更新
zhihang161013/vllm-cpu logo

zhihang161013/vllm-cpu

zhihang161013
暂无描述
299 次下载1 年前更新
lawr/vllm-cpu logo

lawr/vllm-cpu

lawr
暂无描述
289 次下载11 个月前更新
dittops/vllm-cpu logo

dittops/vllm-cpu

dittops
暂无描述
297 次下载11 个月前更新
navchetna/vllm-cpu logo

navchetna/vllm-cpu

navchetna
暂无描述
276 次下载1 年前更新
vijaygawate/vllm-cpu logo

vijaygawate/vllm-cpu

vijaygawate
暂无描述
273 次下载1 年前更新
sivanantha/vllm-cpu logo

sivanantha/vllm-cpu

sivanantha
暂无描述
281 次下载9 个月前更新
ctolon17/vllm-cpu logo

ctolon17/vllm-cpu

ctolon17
暂无描述
115 次下载8 个月前更新
patnaikshekhar/vllm-cpu logo

patnaikshekhar/vllm-cpu

patnaikshekhar
暂无描述
132 次下载2 年前更新
barbicanboost/vllm-cpu logo

barbicanboost/vllm-cpu

barbicanboost
暂无描述
111 次下载6 个月前更新
vllm/vllm-omni logo

vllm/vllm-omni

vLLM 高性能推理与服务镜像
暂无描述
8 次收藏10万+ 次下载6 小时前更新
jiannhuei/vllm-cpu logo

jiannhuei/vllm-cpu

jiannhuei
暂无描述
124 次下载7 个月前更新
linek1/vllm-cpu logo

linek1/vllm-cpu

linek1
暂无描述
124 次下载12 个月前更新
rekasbe353/vllm-cpu logo

rekasbe353/vllm-cpu

rekasbe353
暂无描述
118 次下载1 年前更新
vllm/vllm-tpu logo

vllm/vllm-tpu

vLLM 高性能推理与服务镜像
vLLM框架在TPU上运行的Docker镜像仓库
3 次收藏10万+ 次下载5 小时前更新
nesemenpolkov/vllm-cpu logo

nesemenpolkov/vllm-cpu

nesemenpolkov
为Ubuntu 22.04及以上系统构建的vLLM CPU Docker镜像,用于在CPU环境中运行vLLM推理服务。
94 次下载1 年前更新
vllm/vllm-openai-rocm logo

vllm/vllm-openai-rocm

vLLM 高性能推理与服务镜像
暂无描述
6 次收藏10万+ 次下载6 小时前更新
hoipangg/vllm-cpu logo

hoipangg/vllm-cpu

hoipangg
暂无描述
87 次下载1 年前更新
brunorodrigoss/vllm-cpu logo

brunorodrigoss/vllm-cpu

brunorodrigoss
暂无描述
83 次下载12 个月前更新
yangyaofei/vllm-cpu logo

yangyaofei/vllm-cpu

yangyaofei
暂无描述
83 次下载1 年前更新
vllm/vllm-openai-cpu logo

vllm/vllm-openai-cpu

vLLM 高性能推理与服务镜像
暂无描述
2 次收藏10万+ 次下载6 小时前更新
purushothamkdr453/vllm-cpu logo

purushothamkdr453/vllm-cpu

purushothamkdr453
暂无描述
93 次下载8 个月前更新
mwm5945/vllm-cpu logo

mwm5945/vllm-cpu

mwm5945
暂无描述
85 次下载1 年前更新
tweijian/vllm-cpu logo

tweijian/vllm-cpu

tweijian
暂无描述
69 次下载1 年前更新
fabianbrash2/vllm-cpu logo

fabianbrash2/vllm-cpu

fabianbrash2
custom built vllm that runs on a CPU AVX512 instruction set required
78 次下载3 个月前更新
undivert/vllm-cpu logo

undivert/vllm-cpu

undivert
暂无描述
68 次下载1 年前更新
gwimm/vllm-cpu logo

gwimm/vllm-cpu

gwimm
暂无描述
75 次下载1 年前更新
yicyua01/vllm-cpu logo

yicyua01/vllm-cpu

yicyua01
暂无描述
75 次下载1 年前更新
shivbs/vllm-cpu logo

shivbs/vllm-cpu

shivbs
暂无描述
69 次下载1 年前更新
teamtricuss/vllm-cpu logo

teamtricuss/vllm-cpu

teamtricuss
暂无描述
67 次下载9 个月前更新
clemenskol/vllm-cpu logo

clemenskol/vllm-cpu

clemenskol
暂无描述
57 次下载2 年前更新
gangyub/vllm-cpu logo

gangyub/vllm-cpu

gangyub
暂无描述
63 次下载1 年前更新
duynng/vllm-cpu logo

duynng/vllm-cpu

duynng
暂无描述
51 次下载12 个月前更新
vllm/vllm-openai-xpu logo

vllm/vllm-openai-xpu

vLLM 高性能推理与服务镜像
暂无描述
5万+ 次下载6 小时前更新
vincentmin/vllm-cpu logo

vincentmin/vllm-cpu

vincentmin
暂无描述
48 次下载1 年前更新
vllm/vllm-router logo

vllm/vllm-router

vLLM 高性能推理与服务镜像
暂无描述
1 次收藏1万+ 次下载4 小时前更新
twhite0/vllm-cpu logo

twhite0/vllm-cpu

twhite0
暂无描述
40 次下载1 年前更新
vllm/vllm-omni-rocm logo

vllm/vllm-omni-rocm

vLLM 高性能推理与服务镜像
暂无描述
2 次收藏1万+ 次下载6 天前更新
rocm/vllm-dev logo

rocm/vllm-dev

rocm
rocm/vllm-dev是基于AMD ROCm平台的高性能大语言模型开发镜像,集成vllm框架与AMD GPU加速能力,专为开发者打造大语言模型部署、推理优化及二次开发环境。镜像预配置PyTorch、HIP等核心依赖,支持低延迟、高吞吐量的LLM推理,可快速进行模型加载、性能调优与多实例部署测试,助力开发者高效构建和调试大语言模型应用,充分发挥AMD GPU在AI计算中的算力优势。
20 次收藏100万+ 次下载2 小时前更新
rocm/vllm-ci logo

rocm/vllm-ci

rocm
该仓库用于托管vllm项目持续集成(CI)流程所需的镜像,旨在为vllm-ci相关的自动化构建、测试及部署环节提供稳定的镜像存储与管理支持,确保CI流程高效、可靠地运行,满足vllm项目在开发迭代过程中对集成环境的镜像需求,助力项目快速验证代码变更、保障软件质量。
5 次收藏100万+ 次下载1 小时前更新
rocm/vllm logo

rocm/vllm

rocm
这是为AMD图形处理器(GPU)量身打造的、基于ROCm开源平台深度优化的vLLM Docker容器,其中vLLM作为高性能大语言模型服务库,可提供高效推理与服务能力,Docker容器则保障了部署的便捷性与环境一致性,整体方案旨在为AMD GPU用户提供兼顾性能与易用性的优化大语言模型运行环境。
30 次收藏10万+ 次下载1 天前更新
rocm/vllm-omni logo

rocm/vllm-omni

rocm
repository for hosting vllm-omni images
10万+ 次下载2 小时前更新
vllm/vime logo

vllm/vime

vLLM 高性能推理与服务镜像
暂无描述
1万+ 次下载5 天前更新
intel/vllm logo

intel/vllm

intel
暂无描述
9 次收藏5万+ 次下载1 个月前更新
vllm/vime-rocm logo

vllm/vime-rocm

vLLM 高性能推理与服务镜像
暂无描述
3.4千+ 次下载10 天前更新
ai/kimi-k2-vllm logo

ai/kimi-k2-vllm

Docker AI 官方镜像
Kimi K2 Thinking是最新开源思考模型,作为能逐步推理并动态调用工具的思考代理,具备深度多步推理能力,支持200-300次连续工具调用,原生INT4量化实现低延迟和低GPU内存占用,上下文窗口达256k。
2 次收藏1万+ 次下载9 个月前更新
ai/gpt-oss-vllm logo

ai/gpt-oss-vllm

Docker AI 官方镜像
OpenAI的开源权重模型,专为强大的推理能力和代理任务设计,适用于多用途开发场景。
2 次收藏1万+ 次下载11 个月前更新
ai/glm-4.7-flash-vllm logo

ai/glm-4.7-flash-vllm

Docker AI 官方镜像
GLM-4.7-Flash是顶级的30B-A3B混合专家模型,平衡了强大性能与高效部署,为轻量级部署提供兼顾性能与效率的新选择。
3 次收藏5万+ 次下载8 个月前更新
ai/qwen3-vllm logo

ai/qwen3-vllm

Docker AI 官方镜像
Qwen3是最新一代Qwen大语言模型,专为顶级编码、数学、推理和语言任务设计,支持密集型和混合专家模型架构,提供动态推理模式切换,适用于多语言多领域应用。
1 次收藏1万+ 次下载11 个月前更新
intel/llm-scaler-vllm logo

intel/llm-scaler-vllm

intel
暂无描述
2 次收藏5万+ 次下载12 天前更新
ai/gemma3-vllm logo

ai/gemma3-vllm

Docker AI 官方镜像
Google’s latest Gemma, small yet strong for chat and generation
1 次收藏5万+ 次下载11 个月前更新
ai/all-minilm-l6-v2-vllm logo

ai/all-minilm-l6-v2-vllm

Docker AI 官方镜像
all-MiniLM-L6-v2是一个sentence-transformers模型,可将句子和段落映射到384维密集向量空间,适用于聚类或语义搜索等任务。
1 次收藏1万+ 次下载11 个月前更新
ai/qwen3-coder-next-vllm logo

ai/qwen3-coder-next-vllm

Docker AI 官方镜像
高级编码代理模型,拥有800亿参数(30亿激活MoE),专为编码代理和本地开发环境设计,具备高效代码生成、调试及工具调用能力,支持多种IDE平台集成。
1 次收藏1万+ 次下载7 个月前更新
ai/smollm2-vllm logo

ai/smollm2-vllm

Docker AI 官方镜像
SmolLM 2是为速度、边缘设备和本地开发构建的小型LLM系列,提供135M、360M、1.7B参数版本,以Safetensors格式打包并采用vLLM导向布局,便于通过Docker Hub分发。
2 次收藏1万+ 次下载11 个月前更新
ai/deepseek-v3.2-vllm logo

ai/deepseek-v3.2-vllm

Docker AI 官方镜像
DeepSeek-V3.2通过DeepSeek稀疏注意力(DSA)、可扩展强化学习框架和大规模智能体任务合成管道提升计算效率与推理能力,荣获2025年国际数学奥林匹克(IMO)和国际信息学奥林匹克(IOI)金牌。
11 次收藏5万+ 次下载9 个月前更新
lintoai/vllm logo

lintoai/vllm

lintoai
暂无描述
5万+ 次下载2 个月前更新
rootpublic/vllm-tpu logo

rootpublic/vllm-tpu

rootpublic
暂无描述
2.2千+ 次下载11 个月前更新
rocm/vllm-spur logo

rocm/vllm-spur

rocm
暂无描述
2.1千+ 次下载2 个月前更新
ai/qwen3-reranker-vllm logo

ai/qwen3-reranker-vllm

Docker AI 官方镜像
多语言重排序模型,用于文本检索,可跨119种语言对文档相关性进行评分,基于Qwen3系列基础模型,具备多语言能力、长文本理解和推理技能。
3 次收藏1万+ 次下载10 个月前更新
ai/qwen3-embedding-vllm logo

ai/qwen3-embedding-vllm

Docker AI 官方镜像
Qwen3 Embedding是Qwen系列最新专有模型,专为文本嵌入和排序任务设计,提供0.6B、4B和8B多种尺寸,具备出色的多语言能力、长文本理解和推理技能,适用于文本检索、代码检索、分类、聚类等任务。
2 次收藏1万+ 次下载10 个月前更新
ai/ministral3-vllm logo

ai/ministral3-vllm

Docker AI 官方镜像
Ministral 3是紧凑高效的多模态语言模型,支持视觉和文本输入,性能接近24B模型,专为边缘部署和本地推理优化,适用于资源受限环境。
4 次收藏5万+ 次下载9 个月前更新
openeuler/llm-vllm logo

openeuler/llm-vllm

openeuler
暂无描述
6.6千+ 次下载1 年前更新
vllm/agentic-api logo

vllm/agentic-api

vLLM 高性能推理与服务镜像
暂无描述
163 次下载3 小时前更新
openeuler/vllm-ascend logo

openeuler/vllm-ascend

openeuler
官方vLLM Ascend Docker镜像,基于openEuler构建,是社区维护的硬件插件,用于在Ascend NPU上无缝运行vLLM,支持Transformer、MoE、Embedding、多模态等多种开源模型,遵循硬件可插拔接口规范。
3 次收藏1万+ 次下载2 个月前更新
rocm/vllm-benchmark-ci logo

rocm/vllm-benchmark-ci

rocm
暂无描述
1.4千+ 次下载1 年前更新
espnet/vllm logo

espnet/vllm

espnet
暂无描述
495 次下载6 天前更新
ai/functiongemma-vllm logo

ai/functiongemma-vllm

Docker AI 官方镜像
FunctionGemma是一个270M参数的开放模型,基于Gemma 3构建,专为纯文本函数调用训练,可微调为高效、离线运行的专用代理,适用于资源受限设备。
1 次收藏1万+ 次下载8 个月前更新
ai/embeddinggemma-vllm logo

ai/embeddinggemma-vllm

Docker AI 官方镜像
Embedding Gemma是Google DeepMind推出的最先进文本嵌入模型,基于Gemma架构创建高质量文本向量表示,能捕捉语义含义,适用于检索增强生成(RAG)、语义搜索及相似性任务,为嵌入类应用提供强大基础。
1 次收藏1万+ 次下载11 个月前更新
runpod/worker-v1-vllm logo

runpod/worker-v1-vllm

runpod
暂无描述
4 次收藏100万+ 次下载8 天前更新
vastai/vllm logo

vastai/vllm

vastai
暂无描述
3 次收藏10万+ 次下载1 天前更新
rocmvllm/vllm-openai logo

rocmvllm/vllm-openai

rocmvllm
暂无描述
1 次收藏260 次下载1 年前更新
voipmonitor/vllm logo

voipmonitor/vllm

voipmonitor
针对RTX PRO 6000 Blackwell (SM120a)的vLLM推理栈,基于CUDA 13.2构建,包含Ubuntu 24.04、PyTorch nightly、vLLM、FlashInfer、SGLang等组件,修复了nvidia-cutlass-dsl的NVVM/ptxas版本冲突问题,适用于高性能LLM推理任务。
5 次收藏10万+ 次下载1 天前更新
runpod/worker-vllm logo

runpod/worker-vllm

runpod
暂无描述
6 次收藏10万+ 次下载2 年前更新
mekayelanik/vllm-cpu logo

mekayelanik/vllm-cpu

mekayelanik
vLLM CPU推理引擎 - 为Intel/AMD/ARM64处理器优化的Docker镜像,提供高效的大语言模型服务,支持OpenAI兼容API及多种CPU指令集优化。
1 次收藏1万+ 次下载11 天前更新
第 1 页

与「vllm-cpu」相关的博客与命名空间

相关博客

【漏洞预警】vLLM LlavaOnevision2 处理器绕过 trust_remote_code(CVE-2026-90553)

vLLM 在加载 LlavaOnevision2 处理器时忽略 trust_remote_code,恶意模型可在 processing_llava_onevision2.py 植入任意代码并以 vLLM 进程权限执行(CVE-2026-90553,CVSS 约 7.8 High)。请将 vLLM / vllm-openai 升至 ≥ 0.28.0;未升级前勿加载不受信多模态模型仓库。

Docker部署教程2026/9/13

MinerU Docker 部署指南:PDF 结构化解析服务实践

MinerU 是一款面向开发者与科研用户的容器化应用,专为 vLLM 后端服务设计,提供高效的文档解析与处理能力。通过 Docker 容器化部署 MinerU,可以简化安装流程、确保环境一致性,并便于在不同环境中快速迁移和扩展。 本指南将详细介绍 MinerU 的 Docker 容器化部署方案,包括环境准备、镜像拉取、容器部署、功能测试及生产环境配置建议,旨在帮助用户快速搭建稳定可靠的 MinerU 服务。

Docker部署教程2025/12/30

VLLM Docker 容器化部署指南:在 NVIDIA Jetson 平台高效运行大语言模型推理服务

VLLM是一个高效的开源大语言模型(LLM)推理服务框架,通过创新的PagedAttention技术实现高吞吐量和低延迟的推理性能。本文介绍的`dustynv/vllm`镜像是针对NVIDIA Jetson平台优化的容器化版本,由[dustynv/jetson-containers](https://github.com/dustynv/jetson-containers)项目构建,专为边缘计算场景设计,支持在资源受限的嵌入式设备上部署高性能LLM推理服务。

Docker部署教程2025/12/2

vllm-openai Docker 部署全手册

从个人开发者测试开源大模型,到企业搭建私有推理服务,vllm-openai 都是高效且低成本的选择。本教程将从核心概念讲起,逐步覆盖 Docker 环境准备、镜像拉取、多场景部署、结果验证及问题排查,无论你是初学者还是高级工程师,都能照着步骤完成部署。

Docker部署教程2025/10/9

verl Docker 容器化部署手册

无论你是刚接触大模型工具的初学者,还是需要高效管理训练任务的高级工程师,本教程都将带你一步步完成 verlai/verl 镜像的 Docker 部署——从工具认知、环境搭建到多场景部署实践,每个步骤均配备完整命令与详细说明,确保照着做就能成。

Docker部署教程2025/10/8
轩辕镜像
镜像搜索
...
vllm-cpu
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥8/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥8/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱