轩辕镜像 官方专业版
轩辕镜像
专业版
轩辕镜像 官方专业版
轩辕镜像
专业版
首页个人中心搜索镜像
交易
充值流量¥7起我的订单
文档
工具
提交工单页面收录
让 AI 帮你使用轩辕镜像? · 展开查看说明 · 点击收起说明

如果你使用 DeepSeek、元宝 AI、Copilot、ChatGPT 等 AI 工具,协助配置轩辕镜像、编写 docker pull 命令、修改 Docker Compose 镜像地址、配置镜像加速、排查镜像拉取失败、分析报错日志等问题,请先让 AI 阅读并遵守轩辕镜像的规则文档。

只需在 AI 对话中先发送下面这句话即可:

请先完整阅读并严格遵守以下文档中的全部规则与要求:

https://xuanyuan.cloud/agents.md

在未充分阅读并理解该文档前,不要生成任何命令、配置、修改建议、故障排查方案或技术回答。后续所有输出都必须严格以该文档中的规范为最高优先级执行。

查看 agents.md 用法指南与完整示范。国内用户首推 元宝 AI、DeepSeek 的深度思考模式,不推荐豆包 AI;Cursor 等编辑器可在对话 @ 该链接,或加入 User Rules。 若 AI 无法访问外链,可 打开说明文档 复制全文粘贴。文档会随站点更新,复制内容可能过期,建议定期检查。

架构筛选
ai/qwen3-embedding-vllm logo

ai/qwen3-embedding-vllm

Docker AI 官方镜像
Qwen3 Embedding是Qwen系列最新专有模型,专为文本嵌入和排序任务设计,提供0.6B、4B和8B多种尺寸,具备出色的多语言能力、长文本理解和推理技能,适用于文本检索、代码检索、分类、聚类等任务。
2 次收藏1万+ 次下载8 个月前更新
vllm/vllm-openai logo

vllm/vllm-openai

vLLM 高性能推理与服务镜像
vllm/vllm-openai:vLLM 高性能大模型推理框架的官方 Docker 镜像,封装 OpenAI API 兼容的推理服务;支持 PagedAttention 与连续批处理,吞吐量可达传统引擎 10-24 倍;支持 50+ 开源模型与量化方案,适用开源模型部署、OpenAI 应用本地化与高并发生产场景。
290 次收藏1000万+ 次下载12 天前更新
vllm/vllm-tpu logo

vllm/vllm-tpu

vLLM 高性能推理与服务镜像
vLLM框架在TPU上运行的Docker镜像仓库
3 次收藏10万+ 次下载12 天前更新
vllm/vllm-omni logo

vllm/vllm-omni

vLLM 高性能推理与服务镜像
暂无描述
7 次收藏10万+ 次下载14 天前更新
vllm/vllm-openai-rocm logo

vllm/vllm-openai-rocm

vLLM 高性能推理与服务镜像
暂无描述
5 次收藏10万+ 次下载12 天前更新
vllm/vllm-openai-cpu logo

vllm/vllm-openai-cpu

vLLM 高性能推理与服务镜像
暂无描述
10万+ 次下载22 天前更新
ai/qwen3-vllm logo

ai/qwen3-vllm

Docker AI 官方镜像
Qwen3是最新一代Qwen大语言模型,专为顶级编码、数学、推理和语言任务设计,支持密集型和混合专家模型架构,提供动态推理模式切换,适用于多语言多领域应用。
1 次收藏1万+ 次下载9 个月前更新
ai/qwen3-coder-next-vllm logo

ai/qwen3-coder-next-vllm

Docker AI 官方镜像
高级编码代理模型,拥有800亿参数(30亿激活MoE),专为编码代理和本地开发环境设计,具备高效代码生成、调试及工具调用能力,支持多种IDE平台集成。
1 次收藏1万+ 次下载5 个月前更新
vllm/vllm-router logo

vllm/vllm-router

vLLM 高性能推理与服务镜像
暂无描述
1万+ 次下载12 天前更新
vllm/vllm-omni-rocm logo

vllm/vllm-omni-rocm

vLLM 高性能推理与服务镜像
暂无描述
1 次收藏5.8千+ 次下载1 个月前更新
ai/qwen3-embedding logo

ai/qwen3-embedding

Docker AI 官方镜像
Qwen3 Embedding是Qwen系列最新专有模型,专为文本嵌入和排序任务设计,支持119种语言,提供0.6B、4B、8B等多种尺寸模型,适用于文本检索、代码检索、分类、聚类、平行文本挖掘等高级任务。
1万+ 次下载8 个月前更新
ai/qwen3 logo

ai/qwen3

Docker AI 官方镜像
Qwen3是通义千问系列最新推出的大语言模型,作为新一代人工智能技术成果,它专为顶尖级代码编写、数学计算、逻辑推理及语言处理任务打造,凭借先进的算法架构与深度优化的模型性能,能够高效应对多领域复杂场景下的专业需求,为用户提供精准、智能的解决方案,展现出在技术研发与应用落地中的卓越潜力。
194 次收藏50万+ 次下载8 个月前更新
rocm/vllm-ci logo

rocm/vllm-ci

rocm
该仓库用于托管vllm项目持续集成(CI)流程所需的镜像,旨在为vllm-ci相关的自动化构建、测试及部署环节提供稳定的镜像存储与管理支持,确保CI流程高效、可靠地运行,满足vllm项目在开发迭代过程中对集成环境的镜像需求,助力项目快速验证代码变更、保障软件质量。
5 次收藏100万+ 次下载12 天前更新
ai/qwen3-reranker-vllm logo

ai/qwen3-reranker-vllm

Docker AI 官方镜像
多语言重排序模型,用于文本检索,可跨119种语言对文档相关性进行评分,基于Qwen3系列基础模型,具备多语言能力、长文本理解和推理技能。
3 次收藏1万+ 次下载7 个月前更新
rocm/vllm-dev logo

rocm/vllm-dev

rocm
rocm/vllm-dev是基于AMD ROCm平台的高性能大语言模型开发镜像,集成vllm框架与AMD GPU加速能力,专为开发者打造大语言模型部署、推理优化及二次开发环境。镜像预配置PyTorch、HIP等核心依赖,支持低延迟、高吞吐量的LLM推理,可快速进行模型加载、性能调优与多实例部署测试,助力开发者高效构建和调试大语言模型应用,充分发挥AMD GPU在AI计算中的算力优势。
19 次收藏100万+ 次下载12 天前更新
ai/qwen3.5 logo

ai/qwen3.5

Docker AI 官方镜像
397B MoE model with 17B activation for reasoning, coding, agents, and multimodal understanding
9 次收藏10万+ 次下载3 个月前更新
ai/qwen3-vl logo

ai/qwen3-vl

Docker AI 官方镜像
Qwen系列迄今最强大的视觉语言模型,全面升级文本理解生成、视觉感知推理、上下文长度、空间和视频动态理解能力,具备视觉代理、视觉编码增强、高级空间感知等核心特性。
11 次收藏10万+ 次下载8 个月前更新
ai/qwen3.6 logo

ai/qwen3.6

Docker AI 官方镜像
具备35B混合专家(MoE)架构的多模态AI模型,专注于编码代理、推理和视觉任务,支持262K原生上下文长度(可扩展至100万+ tokens),为软件工程和多模态应用提供高效开发体验。
4 次收藏10万+ 次下载2 个月前更新
ai/qwen3-coder logo

ai/qwen3-coder

Docker AI 官方镜像
Qwen3-Coder是Qwen推出的新一代智能编码代理模型系列。
31 次收藏10万+ 次下载5 个月前更新
rocm/vllm logo

rocm/vllm

rocm
这是为AMD图形处理器(GPU)量身打造的、基于ROCm开源平台深度优化的vLLM Docker容器,其中vLLM作为高性能大语言模型服务库,可提供高效推理与服务能力,Docker容器则保障了部署的便捷性与环境一致性,整体方案旨在为AMD GPU用户提供兼顾性能与易用性的优化大语言模型运行环境。
28 次收藏10万+ 次下载2 个月前更新
rocm/vllm-omni logo

rocm/vllm-omni

rocm
repository for hosting vllm-omni images
10万+ 次下载12 天前更新
ai/qwen3-coder-next logo

ai/qwen3-coder-next

Docker AI 官方镜像
Qwen3-Coder-Next是专为编码代理和本地开发设计的开源语言模型,采用混合专家(MoE)架构,80B总参数中仅激活3B参数实现高效运行,具备256K上下文长度和强大的代理能力,适用于动态编码任务。
2 次收藏5万+ 次下载5 个月前更新
intel/vllm logo

intel/vllm

intel
暂无描述
8 次收藏1万+ 次下载26 天前更新
ai/kimi-k2-vllm logo

ai/kimi-k2-vllm

Docker AI 官方镜像
Kimi K2 Thinking是最新开源思考模型,作为能逐步推理并动态调用工具的思考代理,具备深度多步推理能力,支持200-300次连续工具调用,原生INT4量化实现低延迟和低GPU内存占用,上下文窗口达256k。
2 次收藏1万+ 次下载7 个月前更新
ai/gpt-oss-vllm logo

ai/gpt-oss-vllm

Docker AI 官方镜像
OpenAI的开源权重模型,专为强大的推理能力和代理任务设计,适用于多用途开发场景。
2 次收藏1万+ 次下载9 个月前更新
ai/glm-4.7-flash-vllm logo

ai/glm-4.7-flash-vllm

Docker AI 官方镜像
GLM-4.7-Flash是顶级的30B-A3B混合专家模型,平衡了强大性能与高效部署,为轻量级部署提供兼顾性能与效率的新选择。
3 次收藏1万+ 次下载6 个月前更新
ai/gemma3-vllm logo

ai/gemma3-vllm

Docker AI 官方镜像
Google’s latest Gemma, small yet strong for chat and generation
1 次收藏1万+ 次下载9 个月前更新
intel/llm-scaler-vllm logo

intel/llm-scaler-vllm

intel
暂无描述
2 次收藏1万+ 次下载25 天前更新
vllm/vime logo

vllm/vime

vLLM 高性能推理与服务镜像
暂无描述
694 次下载18 天前更新
qwenllm/qwen3-asr logo

qwenllm/qwen3-asr

qwenllm
暂无描述
2 次收藏5万+ 次下载5 个月前更新
vastai/vllm logo

vastai/vllm

vastai
暂无描述
3 次收藏10万+ 次下载20 天前更新
runpod/worker-v1-vllm logo

runpod/worker-v1-vllm

runpod
暂无描述
4 次收藏50万+ 次下载11 天前更新
novitalabs/vllm-openai logo

novitalabs/vllm-openai

novitalabs
暂无描述
10万+ 次下载1 个月前更新
rocmvllm/vllm-openai logo

rocmvllm/vllm-openai

rocmvllm
暂无描述
1 次收藏199 次下载1 年前更新
dustynv/vllm logo

dustynv/vllm

dustynv
NVIDIA Jetson 平台优化的大语言模型推理服务框架
5 次收藏5万+ 次下载1 年前更新
ascendai/vllm-ascend logo

ascendai/vllm-ascend

ascendai
暂无描述
1 次收藏10万+ 次下载11 天前更新
qwenllm/qwen3-omni logo

qwenllm/qwen3-omni

qwenllm
暂无描述
7 次收藏1万+ 次下载9 个月前更新
voipmonitor/vllm logo

voipmonitor/vllm

voipmonitor
针对RTX PRO 6000 Blackwell (SM120a)的vLLM推理栈,基于CUDA 13.2构建,包含Ubuntu 24.04、PyTorch nightly、vLLM、FlashInfer、SGLang等组件,修复了nvidia-cutlass-dsl的NVVM/ptxas版本冲突问题,适用于高性能LLM推理任务。
3 次收藏1万+ 次下载12 天前更新
yuanmodel/vllm-v0.4.0 logo

yuanmodel/vllm-v0.4.0

yuanmodel
暂无描述
1万+ 次下载2 年前更新
runpod/worker-vllm logo

runpod/worker-vllm

runpod
暂无描述
6 次收藏10万+ 次下载1 年前更新
lmcache/vllm-openai logo

lmcache/vllm-openai

lmcache
暂无描述
8 次收藏10万+ 次下载11 天前更新
mfuntowicz/endpoints-embeddings-qwen3 logo

mfuntowicz/endpoints-embeddings-qwen3

mfuntowicz
暂无描述
1万+ 次下载1 年前更新
第 1 页

与「qwen3-embedding-vllm」相关的博客与命名空间

相关博客

QWEN3 企业级 Docker 容器化部署指南

QWEN3是Qwen LLM系列的最新一代大语言模型,专为顶级编码、数学、推理和语言任务设计。该模型支持密集型(Dense)和混合专家(Mixture-of-Experts, MoE)两种架构,提供从0.6B到235B-A22B等多种规模的模型变体,适用于从轻型应用到大规模研究的各种部署场景。

Docker部署教程2026/1/10
轩辕镜像
镜像搜索
...
qwen3-embedding-vllm
定价查看流量套餐与价格
博客Docker 镜像公告与技术博客
专业版 · 高速稳定拉取镜像
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
50GB 仅 ¥7/年
专业版 · 高速稳定拉取镜像
50GB 仅 ¥7/年
高速镜像下载·在线技术支持·99.95% SLA 保障·付费会员免广告
用户协议·隐私政策·增值电信业务经营许可证:浙B2-20261007·©2024-2026 源码跳动©2024-2026 杭州源码跳动科技有限公司·商务合作:点击复制邮箱