logo
docker.io/vllm/vllm-openai:qwen38-x86_64-cu129
linux/amd64 docker.io
这是镜像描述:

vllm/openai

基于 OpenAI 的 GPT-3 模型的 API 服务,支持自然语言处理等功能。

104
浏览次数
19.53GB
镜像大小
国内镜像
swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129
源镜像
docker.io/vllm/vllm-openai:qwen38-x86_64-cu129
镜像ID
sha256:f5297bab1b355c476888f2e585ace27bf14f0fe01aa6caf5e20d31b0092297cf
镜像 TAG
qwen38-x86_64-cu129
镜像大小
19.53GB
平台架构
linux/amd64
镜像源
docker.io
CMD
启动入口
vllm serve
工作目录
/vllm-workspace
OS/平台
linux/amd64
镜像创建
2026-08-11T14:54:43.018301935Z
同步时间
2026-09-17 01:09
浏览量
104 次
贡献者
⚙️ 环境变量 22
KeyValue
PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin 0
NVARCH=x86_64 1
NVIDIA_REQUIRE_CUDA=cuda>=12.9 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<536 brand=nvidia,driver>=535,driver<536 brand=quadro,driver>=535,driver<536 brand=quadrortx,driver>=535,driver<536 brand=nvidiartx,driver>=535,driver<536 brand=vapps,driver>=535,driver<536 brand=vpc,driver>=535,driver<536 brand=vcs,driver>=535,driver<536 brand=vws,driver>=535,driver<536 brand=cloudgaming,driver>=535,driver<536 brand=unknown,driver>=550,driver<551 brand=grid,driver>=550,driver<551 brand=tesla,driver>=550,driver<551 brand=nvidia,driver>=550,driver<551 brand=quadro,driver>=550,driver<551 brand=quadrortx,driver>=550,driver<551 brand=nvidiartx,driver>=550,driver<551 brand=vapps,driver>=550,driver<551 brand=vpc,driver>=550,driver<551 brand=vcs,driver>=550,driver<551 brand=vws,driver>=550,driver<551 brand=cloudgaming,driver>=550,driver<551 brand=unknown,driver>=560,driver<561 brand=grid,driver>=560,driver<561 brand=tesla,driver>=560,driver<561 brand=nvidia,driver>=560,driver<561 brand=quadro,driver>=560,driver<561 brand=quadrortx,driver>=560,driver<561 brand=nvidiartx,driver>=560,driver<561 brand=vapps,driver>=560,driver<561 brand=vpc,driver>=560,driver<561 brand=vcs,driver>=560,driver<561 brand=vws,driver>=560,driver<561 brand=cloudgaming,driver>=560,driver<561 brand=unknown,driver>=565,driver<566 brand=grid,driver>=565,driver<566 brand=tesla,driver>=565,driver<566 brand=nvidia,driver>=565,driver<566 brand=quadro,driver>=565,driver<566 brand=quadrortx,driver>=565,driver<566 brand=nvidiartx,driver>=565,driver<566 brand=vapps,driver>=565,driver<566 brand=vpc,driver>=565,driver<566 brand=vcs,driver>=565,driver<566 brand=vws,driver>=565,driver<566 brand=cloudgaming,driver>=565,driver<566 brand=unknown,driver>=570,driver<571 brand=grid,driver>=570,driver<571 brand=tesla,driver>=570,driver<571 brand=nvidia,driver>=570,driver<571 brand=quadro,driver>=570,driver<571 brand=quadrortx,driver>=570,driver<571 brand=nvidiartx,driver>=570,driver<571 brand=vapps,driver>=570,driver<571 brand=vpc,driver>=570,driver<571 brand=vcs,driver>=570,driver<571 brand=vws,driver>=570,driver<571 brand=cloudgaming,driver>=570,driver<571 2
NV_CUDA_CUDART_VERSION=12.9.79-1 3
CUDA_VERSION=12.9.1 4
LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64 5
NVIDIA_VISIBLE_DEVICES=all 6
NVIDIA_DRIVER_CAPABILITIES=compute,utility 7
DEBIAN_FRONTEND=noninteractive 8
UV_HTTP_TIMEOUT=500 9
UV_INDEX_STRATEGY=unsafe-best-match 10
UV_LINK_MODE=copy 11
UV_PYTHON_INSTALL_DIR=/opt/uv/python 12
UV_CACHE_DIR=/opt/uv/cache 13
UV_OVERRIDE=/etc/uv-overrides.txt 14
VLLM_ENABLE_CUDA_COMPATIBILITY=0 15
TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0 16
VLLM_USAGE_SOURCE=production-docker-image 17
VLLM_BUILD_COMMIT=3a0914114705fa38d4c3171d0746c1a6b6f10209 18
VLLM_BUILD_PIPELINE=local 19
VLLM_BUILD_URL= 20
VLLM_IMAGE_TAG=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1 21
🏷️ 镜像标签 10
KeyValue
3a0914114705fa38d4c3171d0746c1a6b6f10209 ai.vllm.build.commit
local ai.vllm.build.pipeline
ai.vllm.build.url
inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1 ai.vllm.image.tag
NVIDIA CORPORATION <cudatools@nvidia.com> maintainer
ubuntu org.opencontainers.image.ref.name
3a0914114705fa38d4c3171d0746c1a6b6f10209 org.opencontainers.image.revision
https://github.com/vllm-project/vllm org.opencontainers.image.source
org.opencontainers.image.url
inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1 org.opencontainers.image.version
🛡️ 镜像安全扫描
ubuntu 24.04 Trivy 2026-09-17 01:09 查看完整报告
340
低危 LOW
3043
中危 MEDIUM
197
高危 HIGH
8
严重 CRITICAL
受影响目标 (4)
docker.io/vllm/vllm-openai:qwen38-x86_64-cu129 (ubuntu 24.04) ubuntu Python python-pkg usr/local/bin/uv rustbinary usr/local/bin/uvx rustbinary

Docker拉取命令

docker pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129
docker tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129  docker.io/vllm/vllm-openai:qwen38-x86_64-cu129

Containerd拉取命令

ctr images pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129
ctr images tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129  docker.io/vllm/vllm-openai:qwen38-x86_64-cu129

Shell快速替换命令

sed -i 's#vllm/vllm-openai:qwen38-x86_64-cu129#swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129#' deployment.yaml

Ansible快速分发-Docker

#ansible k8s -m shell -a 'docker pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129 && docker tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129  docker.io/vllm/vllm-openai:qwen38-x86_64-cu129'

Ansible快速分发-Containerd

#ansible k8s -m shell -a 'ctr images pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129 && ctr images tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129  docker.io/vllm/vllm-openai:qwen38-x86_64-cu129'

镜像构建历史


# 2026-08-11 22:54:43  0.00B 配置容器启动时运行的命令
ENTRYPOINT ["vllm" "serve"]
                        
# 2026-08-11 22:54:43  0.00B 添加元数据标签
LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=3a0914114705fa38d4c3171d0746c1a6b6f10209 org.opencontainers.image.version=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1 org.opencontainers.image.url= ai.vllm.build.commit=3a0914114705fa38d4c3171d0746c1a6b6f10209 ai.vllm.build.pipeline=local ai.vllm.build.url= ai.vllm.image.tag=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1
                        
# 2026-08-11 22:54:43  0.00B 设置环境变量 VLLM_BUILD_COMMIT VLLM_BUILD_PIPELINE VLLM_BUILD_URL VLLM_IMAGE_TAG
ENV VLLM_BUILD_COMMIT=3a0914114705fa38d4c3171d0746c1a6b6f10209 VLLM_BUILD_PIPELINE=local VLLM_BUILD_URL= VLLM_IMAGE_TAG=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1
                        
# 2026-08-11 22:54:43  0.00B 设置环境变量 VLLM_USAGE_SOURCE
ENV VLLM_USAGE_SOURCE=production-docker-image
                        
# 2026-08-11 22:54:43  1.02GB 执行命令并创建新的镜像层
RUN |26 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= INSTALL_KV_CONNECTORS=true VLLM_BUILD_COMMIT=3a0914114705fa38d4c3171d0746c1a6b6f10209 VLLM_BUILD_PIPELINE= VLLM_BUILD_URL= VLLM_IMAGE_TAG=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1 torch_cuda_arch_list=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0 /bin/sh -c CUDA_MAJOR="${CUDA_VERSION%%.*}";     CUDA_VERSION_DASH=$(echo $CUDA_VERSION | cut -d. -f1,2 | tr '.' '-');     CUDA_HOME=/usr/local/cuda;     BUILD_PKGS="libcusparse-dev-${CUDA_VERSION_DASH}                 libcublas-dev-${CUDA_VERSION_DASH}                 libcusolver-dev-${CUDA_VERSION_DASH}";     if [ "$INSTALL_KV_CONNECTORS" = "true" ]; then         uv pip install --system -r /tmp/kv_connectors.txt --no-build || (             apt-get update -y &&             apt-get install -y --no-install-recommends --allow-change-held-packages ${BUILD_PKGS} &&             uv pip install --system -r /tmp/kv_connectors.txt --no-build-isolation &&             apt-get purge -y ${BUILD_PKGS} &&             rm -rf /var/lib/apt/lists/*         );         uv pip install --system --force-reinstall --no-deps nixl-cu${CUDA_MAJOR} &&         MOONCAKE_VERSION=$(python3 -c "import importlib.metadata as m; print(m.version('mooncake-transfer-engine'))" 2>/dev/null || true) &&         if [ "${CUDA_MAJOR}" = "13" ] && [ -n "${MOONCAKE_VERSION}" ]; then             uv pip uninstall --system mooncake-transfer-engine 2>/dev/null || true;             uv pip install --system "mooncake-transfer-engine-cuda13==${MOONCAKE_VERSION}";         fi;     fi # buildkit
                        
# 2026-08-11 22:54:20  0.00B 设置环境变量 TORCH_CUDA_ARCH_LIST
ENV TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG torch_cuda_arch_list=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0
                        
# 2026-08-11 22:54:20  0.00B 设置环境变量 UV_HTTP_TIMEOUT
ENV UV_HTTP_TIMEOUT=500
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL=
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG PIP_INDEX_URL UV_INDEX_URL=
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG VLLM_IMAGE_TAG=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG VLLM_BUILD_URL
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG VLLM_BUILD_PIPELINE
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG VLLM_BUILD_COMMIT=3a0914114705fa38d4c3171d0746c1a6b6f10209
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG CUDA_VERSION=12.9.1
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG INSTALL_KV_CONNECTORS=true
                        
# 2026-08-11 22:54:20  0.00B 定义构建参数
ARG TARGETPLATFORM=linux/amd64
                        
# 2026-08-11 22:54:20  35.04KB 复制新文件或目录到容器中
COPY ./vllm/collect_env.py . # buildkit
                        
# 2026-08-11 22:54:20  1.21MB 复制新文件或目录到容器中
COPY benchmarks benchmarks # buildkit
                        
# 2026-08-11 22:54:20  1.33MB 复制新文件或目录到容器中
COPY examples examples # buildkit
                        
# 2026-08-11 22:54:20  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64
                        
# 2026-08-11 22:54:20  51.33MB 执行命令并创建新的镜像层
RUN |20 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c uv pip install --system ep_kernels/dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') # buildkit
                        
# 2026-08-11 22:54:20  146.00B 复制新文件或目录到容器中
COPY /tmp/ep_kernels_workspace/dist/wheels.sha256 /tmp/ep-kernels-wheels.sha256 # buildkit
                        
# 2026-08-11 22:54:20  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/cuda/lib64
                        
# 2026-08-11 22:54:20  0.00B 执行命令并创建新的镜像层
RUN |20 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c . /etc/environment && uv pip list # buildkit
                        
# 2026-08-11 22:54:19  1.62GB 执行命令并创建新的镜像层
RUN |20 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c if [ "${PYTORCH_NIGHTLY}" = "1" ]; then         echo "Installing torch nightly..."         && uv pip install --system $(cat torch_lib_versions.txt | xargs) --pre         --index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/nightly/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.')         && echo "Installing vLLM..."         && uv pip install --system dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/nightly/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.');     else         echo "Installing vLLM..."         && uv pip install --system dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.');     fi # buildkit
                        
# 2026-08-11 22:53:49  133.00B 复制新文件或目录到容器中
COPY /workspace/dist/wheel.sha256 /tmp/vllm-wheel.sha256 # buildkit
                        
# 2026-08-11 22:47:54  71.00B 复制新文件或目录到容器中
COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit
                        
# 2026-08-11 22:47:53  0.00B 定义构建参数
ARG PYTORCH_NIGHTLY
                        
# 2026-08-11 22:47:53  0.00B 定义构建参数
ARG PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled
                        
# 2026-08-11 22:47:53  0.00B 定义构建参数
ARG PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl
                        
# 2026-08-11 22:47:53  0.00B 定义构建参数
ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL=
                        
# 2026-08-11 22:47:53  0.00B 定义构建参数
ARG PIP_INDEX_URL UV_INDEX_URL=
                        
# 2026-08-11 22:47:53  205.61MB 执行命令并创建新的镜像层
RUN |13 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 /bin/sh -c uv pip install --system accelerate 'modelscope<1.38'         "timm${TIMM_VERSION}" "runai-model-streamer[s3,gcs,azure]${RUNAI_MODEL_STREAMER_VERSION}" # buildkit
                        
# 2026-08-11 22:47:48  0.00B 定义构建参数
ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.7
                        
# 2026-08-11 22:47:48  0.00B 定义构建参数
ARG TIMM_VERSION=>=1.0.17
                        
# 2026-08-11 22:47:48  1.64MB 执行命令并创建新的镜像层
RUN |11 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 /bin/sh -c set -eux;     case "${TARGETPLATFORM}" in       linux/arm64) UUARCH="aarch64" ;;       linux/amd64) UUARCH="x64" ;;       *) echo "Unsupported TARGETPLATFORM: ${TARGETPLATFORM}" >&2; exit 1 ;;     esac;     /tmp/install_gdrcopy.sh "${GDRCOPY_OS_VERSION}" "${GDRCOPY_CUDA_VERSION}" "${UUARCH}" &&     rm /tmp/install_gdrcopy.sh # buildkit
                        
# 2026-08-11 22:47:41  1.44KB 复制新文件或目录到容器中
COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit
                        
# 2026-08-11 22:47:41  0.00B 定义构建参数
ARG TARGETPLATFORM=linux/amd64
                        
# 2026-08-11 22:47:41  0.00B 定义构建参数
ARG GDRCOPY_OS_VERSION=Ubuntu24_04
                        
# 2026-08-11 22:47:41  0.00B 定义构建参数
ARG GDRCOPY_CUDA_VERSION=12.8
                        
# 2026-08-11 22:47:41  380.02KB 执行命令并创建新的镜像层
RUN |8 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 /bin/sh -c set -eux;     if [ "${FLASHINFER_VERSION}" = "0.6.17" ]; then         FLASHINFER_GEMM_FILE=$(find /usr/local/lib -type f             -path '*/flashinfer/gemm/gemm_base.py' -print -quit);         test -n "${FLASHINFER_GEMM_FILE}";         FLASHINFER_SITE_PACKAGES=${FLASHINFER_GEMM_FILE%/flashinfer/gemm/gemm_base.py};         for FLASHINFER_PATCH in             /tmp/flashinfer-0.6.17-pr-4266.patch             /tmp/flashinfer-0.6.17-pr-4455.patch; do             patch --batch --forward --fuzz=0                 --directory="${FLASHINFER_SITE_PACKAGES}" --strip=1                 < "${FLASHINFER_PATCH}";         done;     fi;     rm /tmp/flashinfer-0.6.17-pr-4266.patch         /tmp/flashinfer-0.6.17-pr-4455.patch # buildkit
                        
# 2026-08-11 22:47:40  63.53KB 复制新文件或目录到容器中
COPY docker/patches/flashinfer-0.6.17-pr-4266.patch docker/patches/flashinfer-0.6.17-pr-4455.patch /tmp/ # buildkit
                        
# 2026-08-11 22:47:39  2.91GB 执行命令并创建新的镜像层
RUN |8 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.17 /bin/sh -c uv pip install --system flashinfer-jit-cache==${FLASHINFER_VERSION}         --index-url https://flashinfer.ai/whl/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') # buildkit
                        
# 2026-08-11 22:46:04  0.00B 定义构建参数
ARG FLASHINFER_VERSION=0.6.17
                        
# 2026-08-11 22:46:04  9.26GB 执行命令并创建新的镜像层
RUN |7 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl /bin/sh -c if [ "$(echo $CUDA_VERSION | cut -d. -f1)" = "12" ]; then         sed -i 's/^nvidia-cutlass-dsl\[cu13\]/nvidia-cutlass-dsl/' /tmp/requirements-cuda.txt;         sed -i 's/^humming-kernels\[cu13\]/humming-kernels[cu12]/' /tmp/requirements-cuda.txt;     fi &&     uv pip install --system -r /tmp/requirements-cuda.txt         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') &&     rm /tmp/requirements-cuda.txt /tmp/common.txt # buildkit
                        
# 2026-08-11 22:44:32  1.05KB 复制新文件或目录到容器中
COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit
                        
# 2026-08-11 22:44:32  3.22KB 复制新文件或目录到容器中
COPY requirements/common.txt /tmp/common.txt # buildkit
                        
# 2026-08-11 22:44:32  0.00B 定义构建参数
ARG PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl
                        
# 2026-08-11 22:44:32  0.00B 设置环境变量 VLLM_ENABLE_CUDA_COMPATIBILITY
ENV VLLM_ENABLE_CUDA_COMPATIBILITY=0
                        
# 2026-08-11 22:44:32  0.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c chmod 0755 /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit
                        
# 2026-08-11 22:44:32  3.69KB 复制新文件或目录到容器中
COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit
                        
# 2026-08-11 22:44:32  8.87KB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c useradd --uid 2000 --gid 0 --create-home --home-dir /home/vllm         --shell /bin/bash vllm     && mkdir -p /home/vllm/.cache /home/vllm/.config     && chown -R 2000:0 /home/vllm     && chmod -R g+rwX /home/vllm     && chgrp 0 /etc/passwd /etc/group     && chmod g=u /etc/passwd /etc/group # buildkit
                        
# 2026-08-11 22:44:32  0.00B 设置环境变量 UV_OVERRIDE
ENV UV_OVERRIDE=/etc/uv-overrides.txt
                        
# 2026-08-11 22:44:32  25.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c CUDA_MAJOR=$(echo $CUDA_VERSION | cut -d. -f1) &&     if [ -n "$NCCL_VERSION" ]; then         echo "nvidia-nccl-cu${CUDA_MAJOR}==${NCCL_VERSION}"             > /etc/uv-overrides.txt;     else         touch /etc/uv-overrides.txt;     fi # buildkit
                        
# 2026-08-11 22:44:31  0.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c mkdir -p "${UV_PYTHON_INSTALL_DIR}" "${UV_CACHE_DIR}"     && chgrp -R 0 /opt/uv     && chmod -R g+rwX,a+rX /opt/uv # buildkit
                        
# 2026-08-11 22:44:31  0.00B 设置环境变量 UV_CACHE_DIR
ENV UV_CACHE_DIR=/opt/uv/cache
                        
# 2026-08-11 22:44:31  0.00B 设置环境变量 UV_PYTHON_INSTALL_DIR
ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python
                        
# 2026-08-11 22:44:31  0.00B 设置环境变量 UV_LINK_MODE
ENV UV_LINK_MODE=copy
                        
# 2026-08-11 22:44:31  0.00B 设置环境变量 UV_INDEX_STRATEGY
ENV UV_INDEX_STRATEGY=unsafe-best-match
                        
# 2026-08-11 22:44:31  0.00B 设置环境变量 UV_HTTP_TIMEOUT
ENV UV_HTTP_TIMEOUT=500
                        
# 2026-08-11 22:44:31  80.09MB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c python3 -m pip install uv # buildkit
                        
# 2026-08-11 22:44:24  3.32GB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c CUDA_VERSION_DASH=$(echo $CUDA_VERSION | cut -d. -f1,2 | tr '.' '-') &&     apt-get update -y &&     apt-get install -y --no-install-recommends --allow-change-held-packages         cuda-nvcc-${CUDA_VERSION_DASH}         cuda-cudart-${CUDA_VERSION_DASH}         cuda-nvrtc-${CUDA_VERSION_DASH}         cuda-cuobjdump-${CUDA_VERSION_DASH}         libcurand-dev-${CUDA_VERSION_DASH}         libcublas-dev-${CUDA_VERSION_DASH}         libnuma-dev         numactl &&     rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2026-08-11 22:42:44  647.90MB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c apt-get update -y     && apt-get install -y --no-install-recommends         software-properties-common         curl         patch         sudo         ffmpeg         libsm6         libxext6         libgl1     && if [ ! -z ${DEADSNAKES_MIRROR_URL} ] ; then         if [ ! -z "${DEADSNAKES_GPGKEY_URL}" ] ; then             mkdir -p -m 0755 /etc/apt/keyrings ;             curl -L ${DEADSNAKES_GPGKEY_URL} | gpg --dearmor > /etc/apt/keyrings/deadsnakes.gpg ;             sudo chmod 644 /etc/apt/keyrings/deadsnakes.gpg ;             echo "deb [signed-by=/etc/apt/keyrings/deadsnakes.gpg] ${DEADSNAKES_MIRROR_URL} $(lsb_release -cs) main" > /etc/apt/sources.list.d/deadsnakes.list ;         fi ;     else         for i in 1 2 3; do             add-apt-repository -y ppa:deadsnakes/ppa && break ||             { echo "Attempt $i failed, retrying in 5s..."; sleep 5; };         done ;     fi     && apt-get update -y     && apt-get install -y --no-install-recommends         python${PYTHON_VERSION}         python${PYTHON_VERSION}-dev         python${PYTHON_VERSION}-venv         libibverbs-dev     && rm -rf /var/lib/apt/lists/*     && update-alternatives --install /usr/bin/python3 python3 /usr/bin/python${PYTHON_VERSION} 1     && update-alternatives --set python3 /usr/bin/python${PYTHON_VERSION}     && ln -sf /usr/bin/python${PYTHON_VERSION}-config /usr/bin/python3-config     && rm -f /usr/lib/python${PYTHON_VERSION}/EXTERNALLY-MANAGED     && curl -sS ${GET_PIP_URL} | python${PYTHON_VERSION}     && python3 --version && python3 -m pip --version # buildkit
                        
# 2026-08-11 22:38:43  136.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c PYTHON_VERSION_STR=$(echo ${PYTHON_VERSION} | sed 's/\.//g') &&     echo "export PYTHON_VERSION_STR=${PYTHON_VERSION_STR}" >> /etc/environment # buildkit
                        
# 2026-08-11 22:37:25  0.00B 设置工作目录为/vllm-workspace
WORKDIR /vllm-workspace
                        
# 2026-08-11 22:37:25  0.00B 设置环境变量 DEBIAN_FRONTEND
ENV DEBIAN_FRONTEND=noninteractive
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG DEADSNAKES_GPGKEY_URL
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG DEADSNAKES_MIRROR_URL
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG NCCL_VERSION=2.30.7
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG PYTHON_VERSION=3.12
                        
# 2026-08-11 22:37:25  0.00B 定义构建参数
ARG CUDA_VERSION=12.9.1
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 NVIDIA_DRIVER_CAPABILITIES
ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 NVIDIA_VISIBLE_DEVICES
ENV NVIDIA_VISIBLE_DEVICES=all
                        
# 2025-07-19 04:11:18  17.29KB 复制新文件或目录到容器中
COPY NGC-DL-CONTAINER-LICENSE / # buildkit
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 PATH
ENV PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin
                        
# 2025-07-19 04:11:18  22.00B 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf # buildkit
                        
# 2025-07-19 04:11:18  315.62MB 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends     cuda-cudart-12-9=${NV_CUDA_CUDART_VERSION}     cuda-compat-12-9     && rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 CUDA_VERSION
ENV CUDA_VERSION=12.9.1
                        
# 2025-07-19 04:11:02  10.26MB 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends     gnupg2 curl ca-certificates &&     curl -fsSL https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH}/3bf863cc.pub | apt-key add - &&     echo "deb https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH} /" > /etc/apt/sources.list.d/cuda.list &&     apt-get purge --autoremove -y curl     && rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2025-07-19 04:11:02  0.00B 添加元数据标签
LABEL maintainer=NVIDIA CORPORATION <cudatools@nvidia.com>
                        
# 2025-07-19 04:11:02  0.00B 定义构建参数
ARG TARGETARCH
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NV_CUDA_CUDART_VERSION
ENV NV_CUDA_CUDART_VERSION=12.9.79-1
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NVIDIA_REQUIRE_CUDA brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand
ENV NVIDIA_REQUIRE_CUDA=cuda>=12.9 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<536 brand=nvidia,driver>=535,driver<536 brand=quadro,driver>=535,driver<536 brand=quadrortx,driver>=535,driver<536 brand=nvidiartx,driver>=535,driver<536 brand=vapps,driver>=535,driver<536 brand=vpc,driver>=535,driver<536 brand=vcs,driver>=535,driver<536 brand=vws,driver>=535,driver<536 brand=cloudgaming,driver>=535,driver<536 brand=unknown,driver>=550,driver<551 brand=grid,driver>=550,driver<551 brand=tesla,driver>=550,driver<551 brand=nvidia,driver>=550,driver<551 brand=quadro,driver>=550,driver<551 brand=quadrortx,driver>=550,driver<551 brand=nvidiartx,driver>=550,driver<551 brand=vapps,driver>=550,driver<551 brand=vpc,driver>=550,driver<551 brand=vcs,driver>=550,driver<551 brand=vws,driver>=550,driver<551 brand=cloudgaming,driver>=550,driver<551 brand=unknown,driver>=560,driver<561 brand=grid,driver>=560,driver<561 brand=tesla,driver>=560,driver<561 brand=nvidia,driver>=560,driver<561 brand=quadro,driver>=560,driver<561 brand=quadrortx,driver>=560,driver<561 brand=nvidiartx,driver>=560,driver<561 brand=vapps,driver>=560,driver<561 brand=vpc,driver>=560,driver<561 brand=vcs,driver>=560,driver<561 brand=vws,driver>=560,driver<561 brand=cloudgaming,driver>=560,driver<561 brand=unknown,driver>=565,driver<566 brand=grid,driver>=565,driver<566 brand=tesla,driver>=565,driver<566 brand=nvidia,driver>=565,driver<566 brand=quadro,driver>=565,driver<566 brand=quadrortx,driver>=565,driver<566 brand=nvidiartx,driver>=565,driver<566 brand=vapps,driver>=565,driver<566 brand=vpc,driver>=565,driver<566 brand=vcs,driver>=565,driver<566 brand=vws,driver>=565,driver<566 brand=cloudgaming,driver>=565,driver<566 brand=unknown,driver>=570,driver<571 brand=grid,driver>=570,driver<571 brand=tesla,driver>=570,driver<571 brand=nvidia,driver>=570,driver<571 brand=quadro,driver>=570,driver<571 brand=quadrortx,driver>=570,driver<571 brand=nvidiartx,driver>=570,driver<571 brand=vapps,driver>=570,driver<571 brand=vpc,driver>=570,driver<571 brand=vcs,driver>=570,driver<571 brand=vws,driver>=570,driver<571 brand=cloudgaming,driver>=570,driver<571
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NVARCH
ENV NVARCH=x86_64
                        
# 2025-07-15 00:40:23  0.00B 
/bin/sh -c #(nop)  CMD ["/bin/bash"]
                        
# 2025-07-15 00:40:22  78.12MB 
/bin/sh -c #(nop) ADD file:b4619a63cd7829e1338ddaa4995ca17003002dd54b0dfd675a6f54a2b69151a6 in / 
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  LABEL org.opencontainers.image.version=24.04
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  LABEL org.opencontainers.image.ref.name=ubuntu
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  ARG LAUNCHPAD_BUILD_ARCH
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  ARG RELEASE
                        
                    

镜像信息

{
    "Id": "sha256:f5297bab1b355c476888f2e585ace27bf14f0fe01aa6caf5e20d31b0092297cf",
    "RepoTags": [
        "vllm/vllm-openai:qwen38-x86_64-cu129",
        "swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:qwen38-x86_64-cu129"
    ],
    "RepoDigests": [
        "vllm/vllm-openai@sha256:93655f82abeadc079b350cfe22dc578f360cce9dcfb60c09fe022deeb5efc3a3",
        "swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai@sha256:93655f82abeadc079b350cfe22dc578f360cce9dcfb60c09fe022deeb5efc3a3"
    ],
    "Parent": "",
    "Comment": "buildkit.dockerfile.v0",
    "Created": "2026-08-11T14:54:43.018301935Z",
    "Container": "",
    "ContainerConfig": null,
    "DockerVersion": "",
    "Author": "",
    "Config": {
        "Hostname": "",
        "Domainname": "",
        "User": "",
        "AttachStdin": false,
        "AttachStdout": false,
        "AttachStderr": false,
        "Tty": false,
        "OpenStdin": false,
        "StdinOnce": false,
        "Env": [
            "PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin",
            "NVARCH=x86_64",
            "NVIDIA_REQUIRE_CUDA=cuda\u003e=12.9 brand=unknown,driver\u003e=535,driver\u003c536 brand=grid,driver\u003e=535,driver\u003c536 brand=tesla,driver\u003e=535,driver\u003c536 brand=nvidia,driver\u003e=535,driver\u003c536 brand=quadro,driver\u003e=535,driver\u003c536 brand=quadrortx,driver\u003e=535,driver\u003c536 brand=nvidiartx,driver\u003e=535,driver\u003c536 brand=vapps,driver\u003e=535,driver\u003c536 brand=vpc,driver\u003e=535,driver\u003c536 brand=vcs,driver\u003e=535,driver\u003c536 brand=vws,driver\u003e=535,driver\u003c536 brand=cloudgaming,driver\u003e=535,driver\u003c536 brand=unknown,driver\u003e=550,driver\u003c551 brand=grid,driver\u003e=550,driver\u003c551 brand=tesla,driver\u003e=550,driver\u003c551 brand=nvidia,driver\u003e=550,driver\u003c551 brand=quadro,driver\u003e=550,driver\u003c551 brand=quadrortx,driver\u003e=550,driver\u003c551 brand=nvidiartx,driver\u003e=550,driver\u003c551 brand=vapps,driver\u003e=550,driver\u003c551 brand=vpc,driver\u003e=550,driver\u003c551 brand=vcs,driver\u003e=550,driver\u003c551 brand=vws,driver\u003e=550,driver\u003c551 brand=cloudgaming,driver\u003e=550,driver\u003c551 brand=unknown,driver\u003e=560,driver\u003c561 brand=grid,driver\u003e=560,driver\u003c561 brand=tesla,driver\u003e=560,driver\u003c561 brand=nvidia,driver\u003e=560,driver\u003c561 brand=quadro,driver\u003e=560,driver\u003c561 brand=quadrortx,driver\u003e=560,driver\u003c561 brand=nvidiartx,driver\u003e=560,driver\u003c561 brand=vapps,driver\u003e=560,driver\u003c561 brand=vpc,driver\u003e=560,driver\u003c561 brand=vcs,driver\u003e=560,driver\u003c561 brand=vws,driver\u003e=560,driver\u003c561 brand=cloudgaming,driver\u003e=560,driver\u003c561 brand=unknown,driver\u003e=565,driver\u003c566 brand=grid,driver\u003e=565,driver\u003c566 brand=tesla,driver\u003e=565,driver\u003c566 brand=nvidia,driver\u003e=565,driver\u003c566 brand=quadro,driver\u003e=565,driver\u003c566 brand=quadrortx,driver\u003e=565,driver\u003c566 brand=nvidiartx,driver\u003e=565,driver\u003c566 brand=vapps,driver\u003e=565,driver\u003c566 brand=vpc,driver\u003e=565,driver\u003c566 brand=vcs,driver\u003e=565,driver\u003c566 brand=vws,driver\u003e=565,driver\u003c566 brand=cloudgaming,driver\u003e=565,driver\u003c566 brand=unknown,driver\u003e=570,driver\u003c571 brand=grid,driver\u003e=570,driver\u003c571 brand=tesla,driver\u003e=570,driver\u003c571 brand=nvidia,driver\u003e=570,driver\u003c571 brand=quadro,driver\u003e=570,driver\u003c571 brand=quadrortx,driver\u003e=570,driver\u003c571 brand=nvidiartx,driver\u003e=570,driver\u003c571 brand=vapps,driver\u003e=570,driver\u003c571 brand=vpc,driver\u003e=570,driver\u003c571 brand=vcs,driver\u003e=570,driver\u003c571 brand=vws,driver\u003e=570,driver\u003c571 brand=cloudgaming,driver\u003e=570,driver\u003c571",
            "NV_CUDA_CUDART_VERSION=12.9.79-1",
            "CUDA_VERSION=12.9.1",
            "LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64",
            "NVIDIA_VISIBLE_DEVICES=all",
            "NVIDIA_DRIVER_CAPABILITIES=compute,utility",
            "DEBIAN_FRONTEND=noninteractive",
            "UV_HTTP_TIMEOUT=500",
            "UV_INDEX_STRATEGY=unsafe-best-match",
            "UV_LINK_MODE=copy",
            "UV_PYTHON_INSTALL_DIR=/opt/uv/python",
            "UV_CACHE_DIR=/opt/uv/cache",
            "UV_OVERRIDE=/etc/uv-overrides.txt",
            "VLLM_ENABLE_CUDA_COMPATIBILITY=0",
            "TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0",
            "VLLM_USAGE_SOURCE=production-docker-image",
            "VLLM_BUILD_COMMIT=3a0914114705fa38d4c3171d0746c1a6b6f10209",
            "VLLM_BUILD_PIPELINE=local",
            "VLLM_BUILD_URL=",
            "VLLM_IMAGE_TAG=inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1"
        ],
        "Cmd": null,
        "Image": "",
        "Volumes": null,
        "WorkingDir": "/vllm-workspace",
        "Entrypoint": [
            "vllm",
            "serve"
        ],
        "OnBuild": null,
        "Labels": {
            "ai.vllm.build.commit": "3a0914114705fa38d4c3171d0746c1a6b6f10209",
            "ai.vllm.build.pipeline": "local",
            "ai.vllm.build.url": "",
            "ai.vllm.image.tag": "inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1",
            "maintainer": "NVIDIA CORPORATION \u003ccudatools@nvidia.com\u003e",
            "org.opencontainers.image.ref.name": "ubuntu",
            "org.opencontainers.image.revision": "3a0914114705fa38d4c3171d0746c1a6b6f10209",
            "org.opencontainers.image.source": "https://github.com/vllm-project/vllm",
            "org.opencontainers.image.url": "",
            "org.opencontainers.image.version": "inferactinc/dev:wtn-3a09141-x86_64-cu12.9.1"
        }
    },
    "Architecture": "amd64",
    "Os": "linux",
    "Size": 19529421019,
    "GraphDriver": {
        "Data": {
            "LowerDir": "/var/lib/docker/overlay2/40113957f029323aa2f75d3af0295b45035a046352b4edfe4a4ab6e8f36266ae/diff:/var/lib/docker/overlay2/2ad302492d56d9a5b03fa8ee7f2c841d91658a6aa6f94b6d823790a8607b0393/diff:/var/lib/docker/overlay2/238478c7aa57bbbf6782265f0443a23a4501284fc79f2b2b2650bfac6fd0e749/diff:/var/lib/docker/overlay2/be0f2d6f4799f413f74add245e4ca67dfaf4363bc9313ec20c1194129ed0c580/diff:/var/lib/docker/overlay2/63224c0a4720e4ac018b570f3e75bf47318fe21dbaa6f813c46983fb83127093/diff:/var/lib/docker/overlay2/ac4852437f23d9d62bcf0c3c4ace038e5b164471d2ad8591f7034b6f7bc218ed/diff:/var/lib/docker/overlay2/5b3541b282f887e43495441aca13aa37d85ac9e58723009c1ce15a3af2eb297b/diff:/var/lib/docker/overlay2/28870d57b54a6b62295c1582f0a88ce91144590678e5e9787a26f19ec7adc707/diff:/var/lib/docker/overlay2/2e7dbb69767b883d5b538f066e9414e9db6185d1ba833d93d4675084d7ee28cc/diff:/var/lib/docker/overlay2/eb34cf029db1af9c6e7e265235931210f58163fd2c0c45c433f54c513e8ae719/diff:/var/lib/docker/overlay2/25d528a2956d66fa14343d1726915781b447c553c51de2c008c6889600807fe6/diff:/var/lib/docker/overlay2/1867a06194066f9191f38c24ee90e3d2d7fd4677fd7347cf39a4b4b8fed68f72/diff:/var/lib/docker/overlay2/059466106b4268e20b9fc7bb8baa7b011f28cfaddbe61b6ce3d45835672ab7ba/diff:/var/lib/docker/overlay2/18aaf4ac95d7e4ddf030bf4f8089a82c1a6eea621fc69f518b24e5b84ea507b8/diff:/var/lib/docker/overlay2/dcc8a8aef30d716c67a68327aa81fcd08d62e4f8c3a930a41ad1ee10912c105a/diff:/var/lib/docker/overlay2/c99139400a6673cccf68117601cdfc1829991ee97c6c5a3dd9309bfaf6884b39/diff:/var/lib/docker/overlay2/ee843834d9866b94d287c3f0af4825e31fdc5d9dbe69429159a8221962dddee4/diff:/var/lib/docker/overlay2/ef3f17aa21b48499c2d42e905f682ca95fea9ce7526fd4a4c1418fd6f847a5e5/diff:/var/lib/docker/overlay2/2d9bdfeb9c254786d0a6a915494de56beb773825aecd74d7d50edcce39b70d12/diff:/var/lib/docker/overlay2/a07d1826f1ee936719f661d79d5e6370de0f40dac9e9fbc607b81fe975aeac53/diff:/var/lib/docker/overlay2/afadaa12dc4fa92084c55fa97afb50a24229306adf549dc013b876a631beacb1/diff:/var/lib/docker/overlay2/b1e3acc56860eddc6beee82bd88e3be4421a2689f75afffb4c1c000c0f007a46/diff:/var/lib/docker/overlay2/a2f31d777fe89c8c9aae72d65cfc843db5015627e23720f295c3c3ae1d927b84/diff:/var/lib/docker/overlay2/ed70d6acbbe95934a4c3f8999a382330816da9d35e294e2d402a26349f4f99d0/diff:/var/lib/docker/overlay2/021218cd1368e2a49e7818251bcd1abad8a7a2c995a48e10ecdd6792f882a01a/diff:/var/lib/docker/overlay2/b75c4fcf4195cd9a33c058e4314343bdb34ea02bfbdddb8bf2193d8b28ac432f/diff:/var/lib/docker/overlay2/9f9181858da5acdda1f8f4cc415f304c89b1617c79c2fc3064019b60be347ad4/diff:/var/lib/docker/overlay2/d742ab8a37f61a923b1cd864bbee78f727fddb2bea6e79606a8607ce4b44de80/diff:/var/lib/docker/overlay2/156739f9b22c195264a0953fa0e06de5a4d281f6676105dfcb9875d67ce953e8/diff:/var/lib/docker/overlay2/5bbbf2d33f77da0046e7207ef67f1d689ba9c21ead6a914b77f73fa0e2f64bb0/diff:/var/lib/docker/overlay2/445bf948583185955abeddcccee35ccdb131e73b4e53f29bb950913686087f4f/diff:/var/lib/docker/overlay2/c5d8dc7e464fb74848703ccea7d119d0174aa885d6a600f205ad0b59e74190f1/diff:/var/lib/docker/overlay2/4bd152e217e3219b23fd90c08dfa7841d52a4018b5b13a3a70aeb0c6a20bbc04/diff",
            "MergedDir": "/var/lib/docker/overlay2/3f47e0983d129b9c2783ea039182317725c47cf2d2c0b2967e936765d30635fe/merged",
            "UpperDir": "/var/lib/docker/overlay2/3f47e0983d129b9c2783ea039182317725c47cf2d2c0b2967e936765d30635fe/diff",
            "WorkDir": "/var/lib/docker/overlay2/3f47e0983d129b9c2783ea039182317725c47cf2d2c0b2967e936765d30635fe/work"
        },
        "Name": "overlay2"
    },
    "RootFS": {
        "Type": "layers",
        "Layers": [
            "sha256:107cbdaeec042e6154640c94972c638f4e2fee795902b149e8ce9acbd03d59d7",
            "sha256:d54e805fe9aac70390dd3e3ca1b6fd0f63b2cf5913eb0023bf741bd291d2a746",
            "sha256:35a8bdbbbf277997b1e1efcbdc9ae5321ec3a96ceb81ad194ad58d671ab47bd4",
            "sha256:12f5e36b8e7e83c3fa409e1b34eaec072b9381c8a5e600e9f03c53dbd295bec1",
            "sha256:455bca42f6ec40ca42fea4bea15c6c17b97101af90413cdd25647de2b9d98960",
            "sha256:8a4a27f40b326b2101e252f05f4c3725606af663f535425f5ebaa8f1976c64ca",
            "sha256:1b44776ba03bf97881af164fb8e7b49a0a2c0eeb21f2b84cbb1145cef727de7e",
            "sha256:4e2434a6a355354e7a85e22576d407a8289e8508f0a889e8cbcc28375cd5eb7f",
            "sha256:f95061503e176bc0e252ad0c16c9ff81b021d1eebead3bc96f358cf6132f2d23",
            "sha256:87b1eedb39919b3adcfe5f7b89ab1054c3cd80ac7c6d8cc4fe44cb70e05bd99b",
            "sha256:fbfbe7e32710526a6a7585858c853e350b64e00bd02e59ba3778f2151d4b9ca6",
            "sha256:46e6f4be7e5a8849d169260326c3c5854af97bfc46d329333f19c91774b5d368",
            "sha256:f4554bab36f611e99268fdba5b03d96a726b6af279b345a6e3c566d36808b8fb",
            "sha256:3a83c0a5484ad9dda798558b373bd6f87cf362b8bb89739ffb765cdf03b569d3",
            "sha256:5f70bf18a086007016e948b04aed3b82103a36bea41755b6cddfaf10ace3c6ef",
            "sha256:4c5f831b05d4c970d09c03ef3f3568f9d063f700bd77752d9bcc85abc2a9f9d5",
            "sha256:15c551008439b43632f824e49b72963d61b516ab2510a54c08532f2a56242090",
            "sha256:d24c04689e1a186fa91b4193ad1e147ab8fbe500ff3a83a986f32c0230b1f3ab",
            "sha256:36f86f7babae9a1e769e15b054e6701ac343269a6b0f3224144d5387c342c79e",
            "sha256:5d80335ffa08a39ab21a002fa8b3441793b82fd3b2cb50d3b66a8660e477dcbb",
            "sha256:3a8c0782a56a6897015b5fbd996f36e8c77e61712c7278a768682150358a8e94",
            "sha256:17202732565b478f476e0256f15c75aad89262c184e7c2a3f00e2ee06db7f4ef",
            "sha256:eee02009f2f029cb6c8bd363cc82976a1f6387aaf0fc3a44efc1f71c99de583c",
            "sha256:fa0405523a854460b0e215f09f861550990cf3a5c5b19abe9d51b04e4197f70e",
            "sha256:d4f06812d7ec0447f3786e50b417a945af7df679b46c3cfc5002ea963fae2e6e",
            "sha256:c5986ab892631ba015bb602b4f09bc693ea3dbee65f842638d0b8186d886e250",
            "sha256:a86850363e9d25c89f30174cbf5d729affc8a5fdf0184cdd18ad0273de48960b",
            "sha256:5f70bf18a086007016e948b04aed3b82103a36bea41755b6cddfaf10ace3c6ef",
            "sha256:10522db8c4dfb25c846567439e18c591d3218f9869611bd04b66f555c0054b04",
            "sha256:37bf80b0ff5ca6365afd8c4a8b8e8b83ef2693500fb3ac6cdc1754e8a483d263",
            "sha256:7666b79f93b5b43312c20268be674584329f300f75a089f777a036cdda5d3007",
            "sha256:d10f642d57390a940abe243526fa722f2375d2230a644c18ac5c1b20273f9ad6",
            "sha256:5dfed087e42dd144b26d6c250928218b36bea960ee18e8364ae31e57a078c133",
            "sha256:478954002cd11bca4a18076d6148d33841c99bd1bc341fc27549f32923202127"
        ]
    },
    "Metadata": {
        "LastTagTime": "2026-09-17T01:08:59.058552928+08:00"
    }
}

更多版本

docker.io/vllm/vllm-openai-cpu:latest-arm64

linux/arm64 docker.io2.23GB2026-03-28 10:34
517

docker.io/vllm/vllm-openai-cpu:latest-x86_64

linux/amd64 docker.io3.48GB2026-03-28 10:31
746

docker.io/vllm/vllm-openai-cpu:v0.19.0

linux/amd64 docker.io3.49GB2026-04-06 07:48
736

docker.io/vllm/vllm-openai-cpu:v0.19.0

linux/arm64 docker.io2.25GB2026-04-06 07:51
613

docker.io/vllm/vllm-openai-cpu:v0.19.0-x86_64

linux/amd64 docker.io3.49GB2026-04-17 23:45
766

docker.io/vllm/vllm-openai-cpu:v0.22.0

linux/amd64 docker.io13.36GB2026-06-02 00:29
369

docker.io/vllm/vllm-openai-cpu:v0.24.0-arm64

linux/arm64 docker.io2.60GB2026-07-03 23:57
244

docker.io/vllm/vllm-openai-cpu:v0.26.0-x86_64

linux/amd64 docker.io5.51GB2026-07-28 18:03
246

docker.io/vllm/vllm-openai-cpu:v0.29.0-x86_64

linux/amd64 docker.io5.80GB2026-09-11 19:11
103

docker.io/vllm/vllm-openai-rocm:latest

linux/amd64 docker.io24.49GB2026-03-30 00:46
795

docker.io/vllm/vllm-openai-rocm:v0.19.1

linux/amd64 docker.io31.27GB2026-04-24 01:47
586

docker.io/vllm/vllm-openai-rocm:v0.21.0

linux/amd64 docker.io38.56GB2026-05-26 01:41
425

docker.io/vllm/vllm-openai-rocm:v0.26.0

linux/amd64 docker.io33.50GB2026-07-31 03:15
216

docker.io/vllm/vllm-openai-rocm:v0.30.0

linux/amd64 docker.io36.91GB2026-10-01 00:16
62

docker.io/vllm/vllm-openai:cu129-nightly

linux/amd64 docker.io25.87GB2026-06-05 01:09
368

docker.io/vllm/vllm-openai:cu130-nightly

linux/amd64 docker.io19.55GB2026-03-06 02:04
2097

docker.io/vllm/vllm-openai:cu130-nightly-aarch64

linux/arm64 docker.io21.48GB2026-04-14 00:35
951

docker.io/vllm/vllm-openai:deepseekv4-cu129

linux/amd64 docker.io26.33GB2026-04-25 02:11
2247

docker.io/vllm/vllm-openai:deepseekv4-cu130

linux/amd64 docker.io23.06GB2026-04-25 02:38
1939

docker.io/vllm/vllm-openai:deepseekv4-cu130

linux/arm64 docker.io23.40GB2026-04-30 01:00
390

docker.io/vllm/vllm-openai:deepseekv4-flash-vision

linux/amd64 docker.io21.49GB2026-09-04 00:18
170

docker.io/vllm/vllm-openai:deepseekv4-flash-vision-cu129

linux/amd64 docker.io24.76GB2026-09-08 01:20
113

docker.io/vllm/vllm-openai:deepseekv41-flash-0909

linux/amd64 docker.io21.38GB2026-09-11 01:15
248

docker.io/vllm/vllm-openai:deepseekv41-flash-0909-cu129

linux/amd64 docker.io24.70GB2026-09-11 00:25
161

docker.io/vllm/vllm-openai:gemma4

linux/amd64 docker.io23.92GB2026-04-09 00:39
1038

docker.io/vllm/vllm-openai:gemma4

linux/arm64 docker.io23.20GB2026-04-13 03:21
583

docker.io/vllm/vllm-openai:gemma4-0409-x86_64-cu130

linux/amd64 docker.io19.72GB2026-04-12 01:06
721

docker.io/vllm/vllm-openai:gemma4-0505-cu129

linux/amd64 docker.io27.56GB2026-05-07 02:47
533

docker.io/vllm/vllm-openai:gemma4-cu130

linux/amd64 docker.io21.18GB2026-04-04 03:13
2338

docker.io/vllm/vllm-openai:gemma4-cu130

linux/arm64 docker.io20.43GB2026-04-13 01:49
819

docker.io/vllm/vllm-openai:gemma4-unified

linux/arm64 docker.io19.46GB2026-06-11 04:14
270

docker.io/vllm/vllm-openai:glm5

linux/amd64 docker.io20.27GB2026-02-14 00:56
1387

docker.io/vllm/vllm-openai:glm51

linux/amd64 docker.io22.46GB2026-04-16 03:22
773

docker.io/vllm/vllm-openai:glm51

linux/arm64 docker.io23.19GB2026-04-17 01:16
383

docker.io/vllm/vllm-openai:glm51-cu130

linux/amd64 docker.io19.71GB2026-04-17 01:41
678

docker.io/vllm/vllm-openai:glm53-flash

linux/amd64 docker.io19.87GB2026-08-28 02:20
300

docker.io/vllm/vllm-openai:glm53-flash-cu129

linux/amd64 docker.io24.25GB2026-08-28 03:20
209

docker.io/vllm/vllm-openai:glm53-flash-x86_64-cu129

linux/amd64 docker.io24.25GB2026-08-28 05:03
183

docker.io/vllm/vllm-openai:gptoss

linux/amd64 docker.io33.86GB2025-08-07 01:52
1776

docker.io/vllm/vllm-openai:inkling-cu129

linux/amd64 docker.io22.84GB2026-07-21 03:15
173

docker.io/vllm/vllm-openai:latest

linux/amd64 docker.io10.24GB2024-10-11 00:43
12315

docker.io/vllm/vllm-openai:latest

linux/arm64 docker.io20.65GB2026-02-08 00:59
932

docker.io/vllm/vllm-openai:latest-cu129

linux/amd64 docker.io24.27GB2026-08-11 01:48
281

docker.io/vllm/vllm-openai:latest-cu129-ubuntu2404

linux/amd64 docker.io26.67GB2026-05-09 02:37
657

docker.io/vllm/vllm-openai:latest-cu130

linux/amd64 docker.io19.65GB2026-03-31 00:47
1584

docker.io/vllm/vllm-openai:latest-ubuntu2404

linux/arm64 docker.io24.20GB2026-05-14 01:40
269

docker.io/vllm/vllm-openai:latest-x86_64-cu129-ubuntu2404

linux/amd64 docker.io30.16GB2026-06-03 05:05
612

docker.io/vllm/vllm-openai:mimo-v26

linux/amd64 docker.io21.64GB2026-09-24 01:45
87

docker.io/vllm/vllm-openai:mimov25-cu129

linux/amd64 docker.io27.47GB2026-05-01 01:00
787

docker.io/vllm/vllm-openai:minimax-m3

linux/amd64 docker.io18.60GB2026-06-14 00:53
430

docker.io/vllm/vllm-openai:minimax27

linux/amd64 docker.io24.06GB2026-04-14 01:09
722

docker.io/vllm/vllm-openai:muse-glimmer

linux/amd64 docker.io19.81GB2026-08-15 05:38
144

docker.io/vllm/vllm-openai:nightly

linux/amd64 docker.io18.74GB2025-12-03 02:43
4535
324
394
707
890
173
405
685
329
108
689
604
357

docker.io/vllm/vllm-openai:qwen3_5

linux/amd64 docker.io20.93GB2026-02-25 01:18
2008

docker.io/vllm/vllm-openai:qwen3_5-cu130

linux/amd64 docker.io19.60GB2026-04-11 00:51
764

docker.io/vllm/vllm-openai:qwen3_5-x86_64-cu129

linux/amd64 docker.io20.93GB2026-02-27 00:33
982

docker.io/vllm/vllm-openai:qwen38

linux/amd64 docker.io15.11GB2026-08-17 15:14
421

docker.io/vllm/vllm-openai:qwen38

linux/arm64 docker.io16.35GB2026-09-28 01:07
58

docker.io/vllm/vllm-openai:qwen38-cu129

linux/amd64 docker.io19.53GB2026-08-16 00:42
404

docker.io/vllm/vllm-openai:qwen38-flash-next

linux/amd64 docker.io19.84GB2026-08-28 02:43
487

docker.io/vllm/vllm-openai:qwen38-flash-next-x86_64-cu129

linux/amd64 docker.io24.23GB2026-08-28 00:49
283

docker.io/vllm/vllm-openai:qwen38-x86_64-cu129

linux/amd64 docker.io19.53GB2026-09-17 01:09
103

docker.io/vllm/vllm-openai:qwen38-x86_64-cu130

linux/amd64 docker.io15.11GB2026-08-18 00:29
258

docker.io/vllm/vllm-openai:stepfun37

linux/amd64 docker.io23.87GB2026-06-05 02:47
340

docker.io/vllm/vllm-openai:stepfun37-arm64-cu130

linux/arm64 docker.io25.79GB2026-06-06 01:02
192

docker.io/vllm/vllm-openai:unlimited-ocr

linux/amd64 docker.io18.61GB2026-06-29 04:32
788

docker.io/vllm/vllm-openai:unlimited-ocr-cu129

linux/amd64 docker.io24.19GB2026-07-07 01:23
312

docker.io/vllm/vllm-openai:v0.10.0

linux/amd64 docker.io26.13GB2025-07-26 03:15
2747

docker.io/vllm/vllm-openai:v0.10.1

linux/amd64 docker.io20.25GB2025-08-20 03:05
1852

docker.io/vllm/vllm-openai:v0.10.1.1

linux/amd64 docker.io20.26GB2025-08-23 01:43
2973

docker.io/vllm/vllm-openai:v0.10.2

linux/amd64 docker.io22.49GB2025-09-16 03:40
2406

docker.io/vllm/vllm-openai:v0.10.2-x86_64

linux/amd64 docker.io22.49GB2025-10-09 02:22
890

docker.io/vllm/vllm-openai:v0.11.0

linux/amd64 docker.io25.86GB2025-10-09 11:24
3438

docker.io/vllm/vllm-openai:v0.11.0

linux/arm64 docker.io24.17GB2025-10-30 00:47
1477

docker.io/vllm/vllm-openai:v0.11.0-x86_64

linux/amd64 docker.io25.86GB2025-10-09 02:14
3084

docker.io/vllm/vllm-openai:v0.11.1

linux/amd64 docker.io28.72GB2025-11-21 01:03
1115

docker.io/vllm/vllm-openai:v0.11.1

linux/arm64 docker.io26.54GB2025-11-22 01:23
742

docker.io/vllm/vllm-openai:v0.11.2

linux/amd64 docker.io28.82GB2025-11-22 00:46
2545

docker.io/vllm/vllm-openai:v0.11.2

linux/arm64 docker.io26.54GB2025-11-22 04:06
926

docker.io/vllm/vllm-openai:v0.12.0

linux/amd64 docker.io19.47GB2025-12-05 03:59
5458

docker.io/vllm/vllm-openai:v0.12.0-aarch64

linux/arm64 docker.io17.89GB2025-12-05 03:12
1471

docker.io/vllm/vllm-openai:v0.13.0

linux/amd64 docker.io19.51GB2026-01-22 01:41
3112

docker.io/vllm/vllm-openai:v0.13.0

linux/arm64 docker.io17.98GB2026-03-11 03:52
419

docker.io/vllm/vllm-openai:v0.14.0

linux/amd64 docker.io19.66GB2026-01-22 03:16
1046
检测到您正在使用广告拦截插件,本站为公益站点,依赖广告维持运转 🙏 查看如何关闭 ×