logo
docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
linux/amd64 docker.io
这是镜像描述:

vllm/openai

基于 OpenAI 的 GPT-3 模型的 API 服务,支持自然语言处理等功能。

151
浏览次数
24.21GB
镜像大小
国内镜像
swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
源镜像
docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
镜像ID
sha256:1a220276c4350749aee0205f05c28ccd0d2fda0547058842347bad93d1241f40
镜像 TAG
cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
镜像大小
24.21GB
平台架构
linux/amd64
镜像源
docker.io
CMD
启动入口
vllm serve
工作目录
/vllm-workspace
OS/平台
linux/amd64
镜像创建
2026-08-14T05:24:19.310472532Z
同步时间
2026-08-15 05:20
浏览量
151 次
贡献者
⚙️ 环境变量 22
KeyValue
PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin 0
NVARCH=x86_64 1
NVIDIA_REQUIRE_CUDA=cuda>=12.9 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<536 brand=nvidia,driver>=535,driver<536 brand=quadro,driver>=535,driver<536 brand=quadrortx,driver>=535,driver<536 brand=nvidiartx,driver>=535,driver<536 brand=vapps,driver>=535,driver<536 brand=vpc,driver>=535,driver<536 brand=vcs,driver>=535,driver<536 brand=vws,driver>=535,driver<536 brand=cloudgaming,driver>=535,driver<536 brand=unknown,driver>=550,driver<551 brand=grid,driver>=550,driver<551 brand=tesla,driver>=550,driver<551 brand=nvidia,driver>=550,driver<551 brand=quadro,driver>=550,driver<551 brand=quadrortx,driver>=550,driver<551 brand=nvidiartx,driver>=550,driver<551 brand=vapps,driver>=550,driver<551 brand=vpc,driver>=550,driver<551 brand=vcs,driver>=550,driver<551 brand=vws,driver>=550,driver<551 brand=cloudgaming,driver>=550,driver<551 brand=unknown,driver>=560,driver<561 brand=grid,driver>=560,driver<561 brand=tesla,driver>=560,driver<561 brand=nvidia,driver>=560,driver<561 brand=quadro,driver>=560,driver<561 brand=quadrortx,driver>=560,driver<561 brand=nvidiartx,driver>=560,driver<561 brand=vapps,driver>=560,driver<561 brand=vpc,driver>=560,driver<561 brand=vcs,driver>=560,driver<561 brand=vws,driver>=560,driver<561 brand=cloudgaming,driver>=560,driver<561 brand=unknown,driver>=565,driver<566 brand=grid,driver>=565,driver<566 brand=tesla,driver>=565,driver<566 brand=nvidia,driver>=565,driver<566 brand=quadro,driver>=565,driver<566 brand=quadrortx,driver>=565,driver<566 brand=nvidiartx,driver>=565,driver<566 brand=vapps,driver>=565,driver<566 brand=vpc,driver>=565,driver<566 brand=vcs,driver>=565,driver<566 brand=vws,driver>=565,driver<566 brand=cloudgaming,driver>=565,driver<566 brand=unknown,driver>=570,driver<571 brand=grid,driver>=570,driver<571 brand=tesla,driver>=570,driver<571 brand=nvidia,driver>=570,driver<571 brand=quadro,driver>=570,driver<571 brand=quadrortx,driver>=570,driver<571 brand=nvidiartx,driver>=570,driver<571 brand=vapps,driver>=570,driver<571 brand=vpc,driver>=570,driver<571 brand=vcs,driver>=570,driver<571 brand=vws,driver>=570,driver<571 brand=cloudgaming,driver>=570,driver<571 2
NV_CUDA_CUDART_VERSION=12.9.79-1 3
CUDA_VERSION=12.9.1 4
LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64 5
NVIDIA_VISIBLE_DEVICES=all 6
NVIDIA_DRIVER_CAPABILITIES=compute,utility 7
DEBIAN_FRONTEND=noninteractive 8
UV_HTTP_TIMEOUT=500 9
UV_INDEX_STRATEGY=unsafe-best-match 10
UV_LINK_MODE=copy 11
UV_PYTHON_INSTALL_DIR=/opt/uv/python 12
UV_CACHE_DIR=/opt/uv/cache 13
UV_OVERRIDE=/etc/uv-overrides.txt 14
VLLM_ENABLE_CUDA_COMPATIBILITY=0 15
TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 12.0 16
VLLM_USAGE_SOURCE=production-docker-image 17
VLLM_BUILD_COMMIT=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 18
VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b 19
VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/5174 20
VLLM_IMAGE_TAG=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 21
🏷️ 镜像标签 10
KeyValue
ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 ai.vllm.build.commit
019d130e-464e-4ff7-b84b-492992c0c06b ai.vllm.build.pipeline
https://buildkite.com/vllm/release-v2/builds/5174 ai.vllm.build.url
vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 ai.vllm.image.tag
NVIDIA CORPORATION <cudatools@nvidia.com> maintainer
ubuntu org.opencontainers.image.ref.name
ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 org.opencontainers.image.revision
https://github.com/vllm-project/vllm org.opencontainers.image.source
https://buildkite.com/vllm/release-v2/builds/5174 org.opencontainers.image.url
vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 org.opencontainers.image.version
🛡️ 镜像安全扫描
ubuntu 24.04 Trivy 2026-08-15 05:24 查看完整报告
206
低危 LOW
1826
中危 MEDIUM
57
高危 HIGH
0
严重 CRITICAL
受影响目标 (4)
docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 (ubuntu 24.04) ubuntu Python python-pkg usr/local/bin/uv rustbinary usr/local/bin/uvx rustbinary

Docker拉取命令

docker pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
docker tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9  docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9

Containerd拉取命令

ctr images pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
ctr images tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9  docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9

Shell快速替换命令

sed -i 's#vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9#swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9#' deployment.yaml

Ansible快速分发-Docker

#ansible k8s -m shell -a 'docker pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 && docker tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9  docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9'

Ansible快速分发-Containerd

#ansible k8s -m shell -a 'ctr images pull swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 && ctr images tag  swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9  docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9'

镜像构建历史


# 2026-08-14 13:24:19  0.00B 配置容器启动时运行的命令
ENTRYPOINT ["vllm" "serve"]
                        
# 2026-08-14 13:24:19  0.00B 添加元数据标签
LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 org.opencontainers.image.version=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 org.opencontainers.image.url=https://buildkite.com/vllm/release-v2/builds/5174 ai.vllm.build.commit=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 ai.vllm.build.pipeline=019d130e-464e-4ff7-b84b-492992c0c06b ai.vllm.build.url=https://buildkite.com/vllm/release-v2/builds/5174 ai.vllm.image.tag=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
                        
# 2026-08-14 13:24:19  0.00B 设置环境变量 VLLM_BUILD_COMMIT VLLM_BUILD_PIPELINE VLLM_BUILD_URL VLLM_IMAGE_TAG
ENV VLLM_BUILD_COMMIT=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/5174 VLLM_IMAGE_TAG=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9
                        
# 2026-08-14 13:24:19  0.00B 设置环境变量 VLLM_USAGE_SOURCE
ENV VLLM_USAGE_SOURCE=production-docker-image
                        
# 2026-08-14 13:24:19  1.02GB 执行命令并创建新的镜像层
RUN |12 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=12.9.1 VLLM_BUILD_COMMIT=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/5174 VLLM_IMAGE_TAG=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= torch_cuda_arch_list=7.5 8.0 8.6 8.9 9.0 10.0 12.0 /bin/sh -c CUDA_MAJOR="${CUDA_VERSION%%.*}";     CUDA_VERSION_DASH=$(echo $CUDA_VERSION | cut -d. -f1,2 | tr '.' '-');     CUDA_HOME=/usr/local/cuda;     BUILD_PKGS="libcusparse-dev-${CUDA_VERSION_DASH}                 libcublas-dev-${CUDA_VERSION_DASH}                 libcusolver-dev-${CUDA_VERSION_DASH}";     if [ "$INSTALL_KV_CONNECTORS" = "true" ]; then         uv pip install --system -r /tmp/kv_connectors.txt --no-build || (             apt-get update -y &&             apt-get install -y --no-install-recommends --allow-change-held-packages ${BUILD_PKGS} &&             uv pip install --system -r /tmp/kv_connectors.txt --no-build-isolation &&             apt-get purge -y ${BUILD_PKGS} &&             rm -rf /var/lib/apt/lists/*         );         MOONCAKE_VERSION=$(python3 -c "import importlib.metadata as m; print(m.version('mooncake-transfer-engine'))" 2>/dev/null || true) &&         if [ "${CUDA_MAJOR}" = "13" ] && [ -n "${MOONCAKE_VERSION}" ]; then             uv pip uninstall --system mooncake-transfer-engine 2>/dev/null || true;             uv pip install --system "mooncake-transfer-engine-cuda13==${MOONCAKE_VERSION}";         fi;     fi # buildkit
                        
# 2026-08-14 13:24:11  0.00B 设置环境变量 TORCH_CUDA_ARCH_LIST
ENV TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 12.0
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG torch_cuda_arch_list=7.5 8.0 8.6 8.9 9.0 10.0 11.0 12.0
                        
# 2026-08-14 13:24:11  0.00B 设置环境变量 UV_HTTP_TIMEOUT
ENV UV_HTTP_TIMEOUT=500
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG PIP_INDEX_URL UV_INDEX_URL
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG VLLM_IMAGE_TAG
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG VLLM_BUILD_URL
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG VLLM_BUILD_PIPELINE
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG VLLM_BUILD_COMMIT
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG CUDA_VERSION
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG INSTALL_KV_CONNECTORS=false
                        
# 2026-08-14 13:24:11  0.00B 定义构建参数
ARG TARGETPLATFORM
                        
# 2026-08-14 13:24:11  35.04KB 复制新文件或目录到容器中
COPY ./vllm/collect_env.py . # buildkit
                        
# 2026-08-14 13:24:11  1.24MB 复制新文件或目录到容器中
COPY benchmarks benchmarks # buildkit
                        
# 2026-08-14 13:24:11  1.32MB 复制新文件或目录到容器中
COPY examples examples # buildkit
                        
# 2026-08-14 13:24:11  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64
                        
# 2026-08-14 13:24:11  51.33MB 执行命令并创建新的镜像层
RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c uv pip install --system ep_kernels/dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') # buildkit
                        
# 2026-08-14 13:24:10  146.00B 复制新文件或目录到容器中
COPY /tmp/ep_kernels_workspace/dist/wheels.sha256 /tmp/ep-kernels-wheels.sha256 # buildkit
                        
# 2026-08-14 13:24:10  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/cuda/lib64
                        
# 2026-08-14 13:24:10  0.00B 执行命令并创建新的镜像层
RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c . /etc/environment && uv pip list # buildkit
                        
# 2026-08-14 13:24:10  1.63GB 执行命令并创建新的镜像层
RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL= UV_EXTRA_INDEX_URL= PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl PIP_KEYRING_PROVIDER=disabled UV_KEYRING_PROVIDER=disabled PYTORCH_NIGHTLY= /bin/sh -c if [ "${PYTORCH_NIGHTLY}" = "1" ]; then         echo "Installing torch nightly..."         && uv pip install --system $(cat torch_lib_versions.txt | xargs) --pre         --index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/nightly/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.')         && echo "Installing vLLM..."         && uv pip install --system dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/nightly/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.');     else         echo "Installing vLLM..."         && uv pip install --system dist/*.whl --verbose         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.');     fi # buildkit
                        
# 2026-08-14 13:23:59  136.00B 复制新文件或目录到容器中
COPY /workspace/dist/wheel.sha256 /tmp/vllm-wheel.sha256 # buildkit
                        
# 2026-08-14 13:09:12  71.00B 复制新文件或目录到容器中
COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit
                        
# 2026-08-14 13:08:25  0.00B 定义构建参数
ARG PYTORCH_NIGHTLY
                        
# 2026-08-14 13:08:25  0.00B 定义构建参数
ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER
                        
# 2026-08-14 13:08:25  0.00B 定义构建参数
ARG PYTORCH_CUDA_INDEX_BASE_URL
                        
# 2026-08-14 13:08:25  0.00B 定义构建参数
ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL
                        
# 2026-08-14 13:08:25  0.00B 定义构建参数
ARG PIP_INDEX_URL UV_INDEX_URL
                        
# 2026-08-14 13:08:25  205.67MB 执行命令并创建新的镜像层
RUN |13 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.16.post3 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 TIMM_VERSION=>=1.0.17 RUNAI_MODEL_STREAMER_VERSION=>=0.15.7 /bin/sh -c uv pip install --system accelerate 'modelscope<1.38'         "timm${TIMM_VERSION}" "runai-model-streamer[s3,gcs,azure]${RUNAI_MODEL_STREAMER_VERSION}" # buildkit
                        
# 2026-08-14 13:08:22  0.00B 定义构建参数
ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.7
                        
# 2026-08-14 13:08:22  0.00B 定义构建参数
ARG TIMM_VERSION=>=1.0.17
                        
# 2026-08-14 13:08:22  2.46MB 执行命令并创建新的镜像层
RUN |11 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.16.post3 GDRCOPY_CUDA_VERSION=12.8 GDRCOPY_OS_VERSION=Ubuntu24_04 TARGETPLATFORM=linux/amd64 /bin/sh -c set -eux;     case "${TARGETPLATFORM}" in       linux/arm64) UUARCH="aarch64" ;;       linux/amd64) UUARCH="x64" ;;       *) echo "Unsupported TARGETPLATFORM: ${TARGETPLATFORM}" >&2; exit 1 ;;     esac;     /tmp/install_gdrcopy.sh "${GDRCOPY_OS_VERSION}" "${GDRCOPY_CUDA_VERSION}" "${UUARCH}" &&     rm /tmp/install_gdrcopy.sh # buildkit
                        
# 2026-08-14 13:08:16  1.44KB 复制新文件或目录到容器中
COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit
                        
# 2026-08-14 13:08:16  0.00B 定义构建参数
ARG TARGETPLATFORM
                        
# 2026-08-14 13:08:16  0.00B 定义构建参数
ARG GDRCOPY_OS_VERSION=Ubuntu24_04
                        
# 2026-08-14 13:08:16  0.00B 定义构建参数
ARG GDRCOPY_CUDA_VERSION=12.8
                        
# 2026-08-14 13:08:16  2.90GB 执行命令并创建新的镜像层
RUN |8 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl FLASHINFER_VERSION=0.6.16.post3 /bin/sh -c uv pip install --system flashinfer-jit-cache==${FLASHINFER_VERSION}         --index-url https://flashinfer.ai/whl/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') # buildkit
                        
# 2026-08-14 13:07:37  0.00B 定义构建参数
ARG FLASHINFER_VERSION=0.6.16.post3
                        
# 2026-08-14 13:07:37  13.94GB 执行命令并创建新的镜像层
RUN |7 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py PYTORCH_CUDA_INDEX_BASE_URL=https://download.pytorch.org/whl /bin/sh -c if [ "$(echo $CUDA_VERSION | cut -d. -f1)" = "12" ]; then         sed -i 's/^nvidia-cutlass-dsl\[cu13\]/nvidia-cutlass-dsl/' /tmp/requirements-cuda.txt;         sed -i 's/^humming-kernels\[cu13\]/humming-kernels[cu12]/' /tmp/requirements-cuda.txt;     fi &&     uv pip install --system -r /tmp/requirements-cuda.txt         --extra-index-url ${PYTORCH_CUDA_INDEX_BASE_URL}/cu$(echo $CUDA_VERSION | cut -d. -f1,2 | tr -d '.') &&     rm /tmp/requirements-cuda.txt /tmp/common.txt # buildkit
                        
# 2026-08-14 13:05:31  1.23KB 复制新文件或目录到容器中
COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit
                        
# 2026-08-14 13:05:31  3.22KB 复制新文件或目录到容器中
COPY requirements/common.txt /tmp/common.txt # buildkit
                        
# 2026-08-14 13:05:30  0.00B 定义构建参数
ARG PYTORCH_CUDA_INDEX_BASE_URL
                        
# 2026-08-14 13:05:30  0.00B 设置环境变量 VLLM_ENABLE_CUDA_COMPATIBILITY
ENV VLLM_ENABLE_CUDA_COMPATIBILITY=0
                        
# 2026-08-14 13:05:30  3.69KB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c chmod 0755 /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit
                        
# 2026-08-14 13:05:30  3.69KB 复制新文件或目录到容器中
COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit
                        
# 2026-08-14 13:05:30  9.38KB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c useradd --uid 2000 --gid 0 --create-home --home-dir /home/vllm         --shell /bin/bash vllm     && mkdir -p /home/vllm/.cache /home/vllm/.config     && chown -R 2000:0 /home/vllm     && chmod -R g+rwX /home/vllm     && chgrp 0 /etc/passwd /etc/group     && chmod g=u /etc/passwd /etc/group # buildkit
                        
# 2026-08-14 13:05:29  0.00B 设置环境变量 UV_OVERRIDE
ENV UV_OVERRIDE=/etc/uv-overrides.txt
                        
# 2026-08-14 13:05:29  25.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c CUDA_MAJOR=$(echo $CUDA_VERSION | cut -d. -f1) &&     if [ -n "$NCCL_VERSION" ]; then         echo "nvidia-nccl-cu${CUDA_MAJOR}==${NCCL_VERSION}"             > /etc/uv-overrides.txt;     else         touch /etc/uv-overrides.txt;     fi # buildkit
                        
# 2026-08-14 13:05:28  0.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c mkdir -p "${UV_PYTHON_INSTALL_DIR}" "${UV_CACHE_DIR}"     && chgrp -R 0 /opt/uv     && chmod -R g+rwX,a+rX /opt/uv # buildkit
                        
# 2026-08-14 13:05:28  0.00B 设置环境变量 UV_CACHE_DIR
ENV UV_CACHE_DIR=/opt/uv/cache
                        
# 2026-08-14 13:05:28  0.00B 设置环境变量 UV_PYTHON_INSTALL_DIR
ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python
                        
# 2026-08-14 13:05:28  0.00B 设置环境变量 UV_LINK_MODE
ENV UV_LINK_MODE=copy
                        
# 2026-08-14 13:05:28  0.00B 设置环境变量 UV_INDEX_STRATEGY
ENV UV_INDEX_STRATEGY=unsafe-best-match
                        
# 2026-08-14 13:05:28  0.00B 设置环境变量 UV_HTTP_TIMEOUT
ENV UV_HTTP_TIMEOUT=500
                        
# 2026-08-14 13:05:28  84.27MB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c python3 -m pip install uv # buildkit
                        
# 2026-08-14 13:05:25  3.32GB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c CUDA_VERSION_DASH=$(echo $CUDA_VERSION | cut -d. -f1,2 | tr '.' '-') &&     apt-get update -y &&     apt-get install -y --no-install-recommends --allow-change-held-packages         cuda-nvcc-${CUDA_VERSION_DASH}         cuda-cudart-${CUDA_VERSION_DASH}         cuda-nvrtc-${CUDA_VERSION_DASH}         cuda-cuobjdump-${CUDA_VERSION_DASH}         libcurand-dev-${CUDA_VERSION_DASH}         libcublas-dev-${CUDA_VERSION_DASH}         libnuma-dev         numactl &&     rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2026-08-14 13:04:48  647.93MB 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c apt-get update -y     && apt-get install -y --no-install-recommends         software-properties-common         curl         sudo         ffmpeg         libsm6         libxext6         libgl1     && if [ ! -z ${DEADSNAKES_MIRROR_URL} ] ; then         if [ ! -z "${DEADSNAKES_GPGKEY_URL}" ] ; then             mkdir -p -m 0755 /etc/apt/keyrings ;             curl -L ${DEADSNAKES_GPGKEY_URL} | gpg --dearmor > /etc/apt/keyrings/deadsnakes.gpg ;             sudo chmod 644 /etc/apt/keyrings/deadsnakes.gpg ;             echo "deb [signed-by=/etc/apt/keyrings/deadsnakes.gpg] ${DEADSNAKES_MIRROR_URL} $(lsb_release -cs) main" > /etc/apt/sources.list.d/deadsnakes.list ;         fi ;     else         for i in 1 2 3; do             add-apt-repository -y ppa:deadsnakes/ppa && break ||             { echo "Attempt $i failed, retrying in 5s..."; sleep 5; };         done ;     fi     && apt-get update -y     && apt-get install -y --no-install-recommends         python${PYTHON_VERSION}         python${PYTHON_VERSION}-dev         python${PYTHON_VERSION}-venv         libibverbs-dev     && rm -rf /var/lib/apt/lists/*     && update-alternatives --install /usr/bin/python3 python3 /usr/bin/python${PYTHON_VERSION} 1     && update-alternatives --set python3 /usr/bin/python${PYTHON_VERSION}     && ln -sf /usr/bin/python${PYTHON_VERSION}-config /usr/bin/python3-config     && rm -f /usr/lib/python${PYTHON_VERSION}/EXTERNALLY-MANAGED     && curl -sS ${GET_PIP_URL} | python${PYTHON_VERSION}     && python3 --version && python3 -m pip --version # buildkit
                        
# 2026-08-14 13:03:39  136.00B 执行命令并创建新的镜像层
RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7 DEADSNAKES_MIRROR_URL= DEADSNAKES_GPGKEY_URL= GET_PIP_URL=https://bootstrap.pypa.io/get-pip.py /bin/sh -c PYTHON_VERSION_STR=$(echo ${PYTHON_VERSION} | sed 's/\.//g') &&     echo "export PYTHON_VERSION_STR=${PYTHON_VERSION_STR}" >> /etc/environment # buildkit
                        
# 2026-08-14 13:03:37  0.00B 设置工作目录为/vllm-workspace
WORKDIR /vllm-workspace
                        
# 2026-08-14 13:03:37  0.00B 设置环境变量 DEBIAN_FRONTEND
ENV DEBIAN_FRONTEND=noninteractive
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG GET_PIP_URL
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG DEADSNAKES_GPGKEY_URL
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG DEADSNAKES_MIRROR_URL
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG NCCL_VERSION
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG PYTHON_VERSION
                        
# 2026-08-14 13:03:37  0.00B 定义构建参数
ARG CUDA_VERSION
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 NVIDIA_DRIVER_CAPABILITIES
ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 NVIDIA_VISIBLE_DEVICES
ENV NVIDIA_VISIBLE_DEVICES=all
                        
# 2025-07-19 04:11:18  17.29KB 复制新文件或目录到容器中
COPY NGC-DL-CONTAINER-LICENSE / # buildkit
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 LD_LIBRARY_PATH
ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64
                        
# 2025-07-19 04:11:18  0.00B 设置环境变量 PATH
ENV PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin
                        
# 2025-07-19 04:11:18  22.00B 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf # buildkit
                        
# 2025-07-19 04:11:18  315.62MB 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends     cuda-cudart-12-9=${NV_CUDA_CUDART_VERSION}     cuda-compat-12-9     && rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 CUDA_VERSION
ENV CUDA_VERSION=12.9.1
                        
# 2025-07-19 04:11:02  10.26MB 执行命令并创建新的镜像层
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends     gnupg2 curl ca-certificates &&     curl -fsSL https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH}/3bf863cc.pub | apt-key add - &&     echo "deb https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH} /" > /etc/apt/sources.list.d/cuda.list &&     apt-get purge --autoremove -y curl     && rm -rf /var/lib/apt/lists/* # buildkit
                        
# 2025-07-19 04:11:02  0.00B 添加元数据标签
LABEL maintainer=NVIDIA CORPORATION <cudatools@nvidia.com>
                        
# 2025-07-19 04:11:02  0.00B 定义构建参数
ARG TARGETARCH
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NV_CUDA_CUDART_VERSION
ENV NV_CUDA_CUDART_VERSION=12.9.79-1
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NVIDIA_REQUIRE_CUDA brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand brand
ENV NVIDIA_REQUIRE_CUDA=cuda>=12.9 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<536 brand=nvidia,driver>=535,driver<536 brand=quadro,driver>=535,driver<536 brand=quadrortx,driver>=535,driver<536 brand=nvidiartx,driver>=535,driver<536 brand=vapps,driver>=535,driver<536 brand=vpc,driver>=535,driver<536 brand=vcs,driver>=535,driver<536 brand=vws,driver>=535,driver<536 brand=cloudgaming,driver>=535,driver<536 brand=unknown,driver>=550,driver<551 brand=grid,driver>=550,driver<551 brand=tesla,driver>=550,driver<551 brand=nvidia,driver>=550,driver<551 brand=quadro,driver>=550,driver<551 brand=quadrortx,driver>=550,driver<551 brand=nvidiartx,driver>=550,driver<551 brand=vapps,driver>=550,driver<551 brand=vpc,driver>=550,driver<551 brand=vcs,driver>=550,driver<551 brand=vws,driver>=550,driver<551 brand=cloudgaming,driver>=550,driver<551 brand=unknown,driver>=560,driver<561 brand=grid,driver>=560,driver<561 brand=tesla,driver>=560,driver<561 brand=nvidia,driver>=560,driver<561 brand=quadro,driver>=560,driver<561 brand=quadrortx,driver>=560,driver<561 brand=nvidiartx,driver>=560,driver<561 brand=vapps,driver>=560,driver<561 brand=vpc,driver>=560,driver<561 brand=vcs,driver>=560,driver<561 brand=vws,driver>=560,driver<561 brand=cloudgaming,driver>=560,driver<561 brand=unknown,driver>=565,driver<566 brand=grid,driver>=565,driver<566 brand=tesla,driver>=565,driver<566 brand=nvidia,driver>=565,driver<566 brand=quadro,driver>=565,driver<566 brand=quadrortx,driver>=565,driver<566 brand=nvidiartx,driver>=565,driver<566 brand=vapps,driver>=565,driver<566 brand=vpc,driver>=565,driver<566 brand=vcs,driver>=565,driver<566 brand=vws,driver>=565,driver<566 brand=cloudgaming,driver>=565,driver<566 brand=unknown,driver>=570,driver<571 brand=grid,driver>=570,driver<571 brand=tesla,driver>=570,driver<571 brand=nvidia,driver>=570,driver<571 brand=quadro,driver>=570,driver<571 brand=quadrortx,driver>=570,driver<571 brand=nvidiartx,driver>=570,driver<571 brand=vapps,driver>=570,driver<571 brand=vpc,driver>=570,driver<571 brand=vcs,driver>=570,driver<571 brand=vws,driver>=570,driver<571 brand=cloudgaming,driver>=570,driver<571
                        
# 2025-07-19 04:11:02  0.00B 设置环境变量 NVARCH
ENV NVARCH=x86_64
                        
# 2025-07-15 00:40:23  0.00B 
/bin/sh -c #(nop)  CMD ["/bin/bash"]
                        
# 2025-07-15 00:40:22  78.12MB 
/bin/sh -c #(nop) ADD file:b4619a63cd7829e1338ddaa4995ca17003002dd54b0dfd675a6f54a2b69151a6 in / 
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  LABEL org.opencontainers.image.version=24.04
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  LABEL org.opencontainers.image.ref.name=ubuntu
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  ARG LAUNCHPAD_BUILD_ARCH
                        
# 2025-07-15 00:40:20  0.00B 
/bin/sh -c #(nop)  ARG RELEASE
                        
                    

镜像信息

{
    "Id": "sha256:1a220276c4350749aee0205f05c28ccd0d2fda0547058842347bad93d1241f40",
    "RepoTags": [
        "vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9",
        "swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9"
    ],
    "RepoDigests": [
        "vllm/vllm-openai@sha256:05ee4a1e0e0aca547101cd2506018bb5bf83357a0e3288218f0898628da02eb1",
        "swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/vllm/vllm-openai@sha256:ddbe38ab457c87b464ac584c1dd1d00af3b3fc74760741826d8d970d03f833e8"
    ],
    "Parent": "",
    "Comment": "buildkit.dockerfile.v0",
    "Created": "2026-08-14T05:24:19.310472532Z",
    "Container": "",
    "ContainerConfig": null,
    "DockerVersion": "",
    "Author": "",
    "Config": {
        "Hostname": "",
        "Domainname": "",
        "User": "",
        "AttachStdin": false,
        "AttachStdout": false,
        "AttachStderr": false,
        "Tty": false,
        "OpenStdin": false,
        "StdinOnce": false,
        "Env": [
            "PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin",
            "NVARCH=x86_64",
            "NVIDIA_REQUIRE_CUDA=cuda\u003e=12.9 brand=unknown,driver\u003e=535,driver\u003c536 brand=grid,driver\u003e=535,driver\u003c536 brand=tesla,driver\u003e=535,driver\u003c536 brand=nvidia,driver\u003e=535,driver\u003c536 brand=quadro,driver\u003e=535,driver\u003c536 brand=quadrortx,driver\u003e=535,driver\u003c536 brand=nvidiartx,driver\u003e=535,driver\u003c536 brand=vapps,driver\u003e=535,driver\u003c536 brand=vpc,driver\u003e=535,driver\u003c536 brand=vcs,driver\u003e=535,driver\u003c536 brand=vws,driver\u003e=535,driver\u003c536 brand=cloudgaming,driver\u003e=535,driver\u003c536 brand=unknown,driver\u003e=550,driver\u003c551 brand=grid,driver\u003e=550,driver\u003c551 brand=tesla,driver\u003e=550,driver\u003c551 brand=nvidia,driver\u003e=550,driver\u003c551 brand=quadro,driver\u003e=550,driver\u003c551 brand=quadrortx,driver\u003e=550,driver\u003c551 brand=nvidiartx,driver\u003e=550,driver\u003c551 brand=vapps,driver\u003e=550,driver\u003c551 brand=vpc,driver\u003e=550,driver\u003c551 brand=vcs,driver\u003e=550,driver\u003c551 brand=vws,driver\u003e=550,driver\u003c551 brand=cloudgaming,driver\u003e=550,driver\u003c551 brand=unknown,driver\u003e=560,driver\u003c561 brand=grid,driver\u003e=560,driver\u003c561 brand=tesla,driver\u003e=560,driver\u003c561 brand=nvidia,driver\u003e=560,driver\u003c561 brand=quadro,driver\u003e=560,driver\u003c561 brand=quadrortx,driver\u003e=560,driver\u003c561 brand=nvidiartx,driver\u003e=560,driver\u003c561 brand=vapps,driver\u003e=560,driver\u003c561 brand=vpc,driver\u003e=560,driver\u003c561 brand=vcs,driver\u003e=560,driver\u003c561 brand=vws,driver\u003e=560,driver\u003c561 brand=cloudgaming,driver\u003e=560,driver\u003c561 brand=unknown,driver\u003e=565,driver\u003c566 brand=grid,driver\u003e=565,driver\u003c566 brand=tesla,driver\u003e=565,driver\u003c566 brand=nvidia,driver\u003e=565,driver\u003c566 brand=quadro,driver\u003e=565,driver\u003c566 brand=quadrortx,driver\u003e=565,driver\u003c566 brand=nvidiartx,driver\u003e=565,driver\u003c566 brand=vapps,driver\u003e=565,driver\u003c566 brand=vpc,driver\u003e=565,driver\u003c566 brand=vcs,driver\u003e=565,driver\u003c566 brand=vws,driver\u003e=565,driver\u003c566 brand=cloudgaming,driver\u003e=565,driver\u003c566 brand=unknown,driver\u003e=570,driver\u003c571 brand=grid,driver\u003e=570,driver\u003c571 brand=tesla,driver\u003e=570,driver\u003c571 brand=nvidia,driver\u003e=570,driver\u003c571 brand=quadro,driver\u003e=570,driver\u003c571 brand=quadrortx,driver\u003e=570,driver\u003c571 brand=nvidiartx,driver\u003e=570,driver\u003c571 brand=vapps,driver\u003e=570,driver\u003c571 brand=vpc,driver\u003e=570,driver\u003c571 brand=vcs,driver\u003e=570,driver\u003c571 brand=vws,driver\u003e=570,driver\u003c571 brand=cloudgaming,driver\u003e=570,driver\u003c571",
            "NV_CUDA_CUDART_VERSION=12.9.79-1",
            "CUDA_VERSION=12.9.1",
            "LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib64",
            "NVIDIA_VISIBLE_DEVICES=all",
            "NVIDIA_DRIVER_CAPABILITIES=compute,utility",
            "DEBIAN_FRONTEND=noninteractive",
            "UV_HTTP_TIMEOUT=500",
            "UV_INDEX_STRATEGY=unsafe-best-match",
            "UV_LINK_MODE=copy",
            "UV_PYTHON_INSTALL_DIR=/opt/uv/python",
            "UV_CACHE_DIR=/opt/uv/cache",
            "UV_OVERRIDE=/etc/uv-overrides.txt",
            "VLLM_ENABLE_CUDA_COMPATIBILITY=0",
            "TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.9 9.0 10.0 12.0",
            "VLLM_USAGE_SOURCE=production-docker-image",
            "VLLM_BUILD_COMMIT=ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9",
            "VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b",
            "VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/5174",
            "VLLM_IMAGE_TAG=vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9"
        ],
        "Cmd": null,
        "Image": "",
        "Volumes": null,
        "WorkingDir": "/vllm-workspace",
        "Entrypoint": [
            "vllm",
            "serve"
        ],
        "OnBuild": null,
        "Labels": {
            "ai.vllm.build.commit": "ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9",
            "ai.vllm.build.pipeline": "019d130e-464e-4ff7-b84b-492992c0c06b",
            "ai.vllm.build.url": "https://buildkite.com/vllm/release-v2/builds/5174",
            "ai.vllm.image.tag": "vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9",
            "maintainer": "NVIDIA CORPORATION \u003ccudatools@nvidia.com\u003e",
            "org.opencontainers.image.ref.name": "ubuntu",
            "org.opencontainers.image.revision": "ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9",
            "org.opencontainers.image.source": "https://github.com/vllm-project/vllm",
            "org.opencontainers.image.url": "https://buildkite.com/vllm/release-v2/builds/5174",
            "org.opencontainers.image.version": "vllm/vllm-openai:cu129-nightly-ac7509e2b1db40fec2f03dde1ed4e9dfdc2338c9"
        }
    },
    "Architecture": "amd64",
    "Os": "linux",
    "Size": 24205227556,
    "GraphDriver": {
        "Data": {
            "LowerDir": "/var/lib/docker/overlay2/92ef72574840859bb6620e0af4dcadef42bc26c7e50e865417b6dba665527d1d/diff:/var/lib/docker/overlay2/5ef699adef613d55be7bda0196ab74d74e1e2161a9d81b0167863fbbb457ed76/diff:/var/lib/docker/overlay2/a739c2a9e31a6655a4327f22dc73f1ffdc81d6928bf9867336138946dfcbd7c2/diff:/var/lib/docker/overlay2/3c7c6a7d3b2c6498e3ca24d077e01e3da64d177ee72ef6b28c6f89ce255c8276/diff:/var/lib/docker/overlay2/2b4b23b5ce13099dd87219b1e57f008e0df18b5ed9a7fe625b0bb13abeabc9b8/diff:/var/lib/docker/overlay2/06c4215e3ecd02a8bde47780caa8eb02331b40ecc6b3c5913bc2df046c7e9ab8/diff:/var/lib/docker/overlay2/5f9c0fbdd88622721b04797284fb680e5bfa7eea5dd5bf6db01ef80b9ee1101a/diff:/var/lib/docker/overlay2/b6367416e7d98eb3d18bc1a0353cf3d8dbef97f40b233b354cbcb1570002b4a0/diff:/var/lib/docker/overlay2/8feac3f5643c27a2a0d4b5a549d7aa07407219932cd76632d9b4ee88b0f98e4f/diff:/var/lib/docker/overlay2/8710d127e604ecb5e77a3944f74aea8a6ba18503c0a7db8c0c215734e363e4e5/diff:/var/lib/docker/overlay2/e6bf8c768948f853e1efe71f44794361a60045393cfffa92227051111d9dd443/diff:/var/lib/docker/overlay2/bf967b7e36545af53346975d6b9db44190740ce1ff3de10261829461eec2f411/diff:/var/lib/docker/overlay2/e3fe2236928dae2ec7aa6b4e30afe6d37c72dbc6f57eb82344a5683a5298f051/diff:/var/lib/docker/overlay2/f04b453808884037e25cba5aba149fab09cb91ecabf609aa6ac1f3a811cac024/diff:/var/lib/docker/overlay2/054b2a0a63c424ae29727057e5d0168b506a9c997375ae4801594d4b154dcdde/diff:/var/lib/docker/overlay2/9502d82ab5936ea599879099ac0ae110ecf3e816c7ca19f0f01ea5c375029ab9/diff:/var/lib/docker/overlay2/d61c4e98c291c936f9f038473b700522c5099b80c1533fa5a588545fdf502447/diff:/var/lib/docker/overlay2/821f3b23991241807bfa9eccc4d6f0c4d2b87a17f1a9927f41b6e0d48607fe72/diff:/var/lib/docker/overlay2/bfee4bc3117659ffb0ea7f42e7c5ccde53ae2916f4de4080974500bbb47d3962/diff:/var/lib/docker/overlay2/ff49237be0a8065c2cecef3fe2befc58491df5ed75e87dc4208785f4081d2877/diff:/var/lib/docker/overlay2/9323ecae6b20ce4b25712039a3bb06586dca79a94ddda95015dc9be97093e9ba/diff:/var/lib/docker/overlay2/ce133d153d1c4c27f8b3555510f411fff288d39cef6ecc67eaa0c3f73897debc/diff:/var/lib/docker/overlay2/ad511c5386423ad0a922c485f7e6fda3becf82598fc14e85515cb38e6d67bffc/diff:/var/lib/docker/overlay2/f64fb6abde457ae66fc13fb2ade5f0515876fe0e68b05fd6b6c431a308465eb0/diff:/var/lib/docker/overlay2/4377d864b5c78465fa4fb0a944d26440ed672f6d81946d2435a068a82f719bb1/diff:/var/lib/docker/overlay2/37bd69a56079638a56eae9bdda3cee7a8ede9538be14bc7cf7312ab83821464c/diff:/var/lib/docker/overlay2/156739f9b22c195264a0953fa0e06de5a4d281f6676105dfcb9875d67ce953e8/diff:/var/lib/docker/overlay2/5bbbf2d33f77da0046e7207ef67f1d689ba9c21ead6a914b77f73fa0e2f64bb0/diff:/var/lib/docker/overlay2/445bf948583185955abeddcccee35ccdb131e73b4e53f29bb950913686087f4f/diff:/var/lib/docker/overlay2/c5d8dc7e464fb74848703ccea7d119d0174aa885d6a600f205ad0b59e74190f1/diff:/var/lib/docker/overlay2/4bd152e217e3219b23fd90c08dfa7841d52a4018b5b13a3a70aeb0c6a20bbc04/diff",
            "MergedDir": "/var/lib/docker/overlay2/82a8c99a85cefebb14a9a3cebc7a4ecd2a786e439e27bcc53922579544b404d3/merged",
            "UpperDir": "/var/lib/docker/overlay2/82a8c99a85cefebb14a9a3cebc7a4ecd2a786e439e27bcc53922579544b404d3/diff",
            "WorkDir": "/var/lib/docker/overlay2/82a8c99a85cefebb14a9a3cebc7a4ecd2a786e439e27bcc53922579544b404d3/work"
        },
        "Name": "overlay2"
    },
    "RootFS": {
        "Type": "layers",
        "Layers": [
            "sha256:107cbdaeec042e6154640c94972c638f4e2fee795902b149e8ce9acbd03d59d7",
            "sha256:d54e805fe9aac70390dd3e3ca1b6fd0f63b2cf5913eb0023bf741bd291d2a746",
            "sha256:35a8bdbbbf277997b1e1efcbdc9ae5321ec3a96ceb81ad194ad58d671ab47bd4",
            "sha256:12f5e36b8e7e83c3fa409e1b34eaec072b9381c8a5e600e9f03c53dbd295bec1",
            "sha256:455bca42f6ec40ca42fea4bea15c6c17b97101af90413cdd25647de2b9d98960",
            "sha256:8066bcef78fb5f24e67032c00b3187b9518f01b80ee506ba12db8f4f10b68be7",
            "sha256:9538dece833ec8b19df486538e1f388fa38264b5f321639487253a9c9423b816",
            "sha256:7c4b92e55e140c2e351357d5036f737fb7b6170ec30af2d1040361ac82a3915b",
            "sha256:e987a903cc0ad60dcc66ab94d11afc43066655184a281e0611fd188a9962c0cb",
            "sha256:c1bff88ed1d1fd5e263933188ac2cebee9f922dff91b4f8c661d071212cef158",
            "sha256:377b2f74b34cab2b8cec42ffe895373bbdd83434d17ce7d6440878b68bc20684",
            "sha256:689edd648aca357690f273625fdf537c78c1f2d1ee60ee4fa3b743bb8cfa16a5",
            "sha256:1752db6a3424b7e9115f58f34f0091d59e2173793ccc76d5e39c3ec19bbcff5c",
            "sha256:210581408406e4dd9428c913c1677bf46ecbfc5a4c41fcb0c331af180a64b9cd",
            "sha256:210581408406e4dd9428c913c1677bf46ecbfc5a4c41fcb0c331af180a64b9cd",
            "sha256:606bb77357645d344865953e1a1529e59be39474bb7bba4659577a8fe07ead53",
            "sha256:779ef1b40bc6d358446d72b3372ca59c645447f2323f3896f6cef06e31f06cd6",
            "sha256:e37db2787bbbd0b1556910e8a829d500e9af2871f520268e0eeb3176f892bdbd",
            "sha256:5a3adea26cae8a3e26aaedb129af86325f4bc6e0e50d2b9a58b9e5d80b9e97c7",
            "sha256:ae524cc4644c057bb514572044801405d0382f554e8bd13456b930b3920f280c",
            "sha256:4a83944fa186a6a8c88b43c5407e96e2d2c0d0bbdac5341fda991f09ef05be17",
            "sha256:4312ad7f8b3f1dcab52a98f3d793ee80c835be607a219683d628f8efc4e3172b",
            "sha256:8f139ce7b546cef6d01dee4189e93b66873928049b403ca7fef4dedb64537117",
            "sha256:9b17e7217d112d440ae83d1710ea7d244e611a646f41b1a8d4429b8bd8e0ff87",
            "sha256:9466468c07b054c39bda4e682bd700e913f7de055340fe632fc84f8fd4e9d690",
            "sha256:5f70bf18a086007016e948b04aed3b82103a36bea41755b6cddfaf10ace3c6ef",
            "sha256:944efe50d66316011007560dab36d64f4652feec4f675a0dffacd9819e3f8060",
            "sha256:fa2cd1dec11514e7ec17098fb18d0647350247bce8d841705bc323a9872128f4",
            "sha256:f96550afcebf6fbd42de30bbd6fa128971ff11e087218a125ce29447af22619b",
            "sha256:1fbfb38b34eb7a8c4c87ccf1644eac773c2cba0f27da9fae37959e427a794e38",
            "sha256:e0dd701a4a6fb7e20949f92328f06e6a81c032d6a1ad55a188fea18d3d2f6ae0",
            "sha256:9d156c1a6cc29147d7444fb62a935b0622d9045c07593e946db2e05a8cb4b885"
        ]
    },
    "Metadata": {
        "LastTagTime": "2026-08-15T05:05:33.558274686+08:00"
    }
}

更多版本

docker.io/vllm/vllm-openai-cpu:latest-arm64

linux/arm64 docker.io2.23GB2026-03-28 10:34
500

docker.io/vllm/vllm-openai-cpu:latest-x86_64

linux/amd64 docker.io3.48GB2026-03-28 10:31
721

docker.io/vllm/vllm-openai-cpu:v0.19.0

linux/amd64 docker.io3.49GB2026-04-06 07:48
707

docker.io/vllm/vllm-openai-cpu:v0.19.0

linux/arm64 docker.io2.25GB2026-04-06 07:51
603

docker.io/vllm/vllm-openai-cpu:v0.19.0-x86_64

linux/amd64 docker.io3.49GB2026-04-17 23:45
742

docker.io/vllm/vllm-openai-cpu:v0.22.0

linux/amd64 docker.io13.36GB2026-06-02 00:29
342

docker.io/vllm/vllm-openai-cpu:v0.24.0-arm64

linux/arm64 docker.io2.60GB2026-07-03 23:57
229

docker.io/vllm/vllm-openai-cpu:v0.26.0-x86_64

linux/amd64 docker.io5.51GB2026-07-28 18:03
220

docker.io/vllm/vllm-openai-cpu:v0.29.0-x86_64

linux/amd64 docker.io5.80GB2026-09-11 19:11
83

docker.io/vllm/vllm-openai-rocm:latest

linux/amd64 docker.io24.49GB2026-03-30 00:46
757

docker.io/vllm/vllm-openai-rocm:v0.19.1

linux/amd64 docker.io31.27GB2026-04-24 01:47
560

docker.io/vllm/vllm-openai-rocm:v0.21.0

linux/amd64 docker.io38.56GB2026-05-26 01:41
388

docker.io/vllm/vllm-openai-rocm:v0.26.0

linux/amd64 docker.io33.50GB2026-07-31 03:15
190

docker.io/vllm/vllm-openai:cu129-nightly

linux/amd64 docker.io25.87GB2026-06-05 01:09
344

docker.io/vllm/vllm-openai:cu130-nightly

linux/amd64 docker.io19.55GB2026-03-06 02:04
2055

docker.io/vllm/vllm-openai:cu130-nightly-aarch64

linux/arm64 docker.io21.48GB2026-04-14 00:35
939

docker.io/vllm/vllm-openai:deepseekv4-cu129

linux/amd64 docker.io26.33GB2026-04-25 02:11
2212

docker.io/vllm/vllm-openai:deepseekv4-cu130

linux/amd64 docker.io23.06GB2026-04-25 02:38
1911

docker.io/vllm/vllm-openai:deepseekv4-cu130

linux/arm64 docker.io23.40GB2026-04-30 01:00
373

docker.io/vllm/vllm-openai:deepseekv4-flash-vision

linux/amd64 docker.io21.49GB2026-09-04 00:18
144

docker.io/vllm/vllm-openai:deepseekv4-flash-vision-cu129

linux/amd64 docker.io24.76GB2026-09-08 01:20
94

docker.io/vllm/vllm-openai:deepseekv41-flash-0909

linux/amd64 docker.io21.38GB2026-09-11 01:15
223

docker.io/vllm/vllm-openai:deepseekv41-flash-0909-cu129

linux/amd64 docker.io24.70GB2026-09-11 00:25
142

docker.io/vllm/vllm-openai:gemma4

linux/amd64 docker.io23.92GB2026-04-09 00:39
1010

docker.io/vllm/vllm-openai:gemma4

linux/arm64 docker.io23.20GB2026-04-13 03:21
568

docker.io/vllm/vllm-openai:gemma4-0409-x86_64-cu130

linux/amd64 docker.io19.72GB2026-04-12 01:06
699

docker.io/vllm/vllm-openai:gemma4-0505-cu129

linux/amd64 docker.io27.56GB2026-05-07 02:47
510

docker.io/vllm/vllm-openai:gemma4-cu130

linux/amd64 docker.io21.18GB2026-04-04 03:13
2303

docker.io/vllm/vllm-openai:gemma4-cu130

linux/arm64 docker.io20.43GB2026-04-13 01:49
799

docker.io/vllm/vllm-openai:gemma4-unified

linux/arm64 docker.io19.46GB2026-06-11 04:14
259

docker.io/vllm/vllm-openai:glm5

linux/amd64 docker.io20.27GB2026-02-14 00:56
1340

docker.io/vllm/vllm-openai:glm51

linux/amd64 docker.io22.46GB2026-04-16 03:22
744

docker.io/vllm/vllm-openai:glm51

linux/arm64 docker.io23.19GB2026-04-17 01:16
369

docker.io/vllm/vllm-openai:glm51-cu130

linux/amd64 docker.io19.71GB2026-04-17 01:41
637

docker.io/vllm/vllm-openai:glm53-flash

linux/amd64 docker.io19.87GB2026-08-28 02:20
263

docker.io/vllm/vllm-openai:glm53-flash-cu129

linux/amd64 docker.io24.25GB2026-08-28 03:20
166

docker.io/vllm/vllm-openai:glm53-flash-x86_64-cu129

linux/amd64 docker.io24.25GB2026-08-28 05:03
161

docker.io/vllm/vllm-openai:gptoss

linux/amd64 docker.io33.86GB2025-08-07 01:52
1761

docker.io/vllm/vllm-openai:inkling-cu129

linux/amd64 docker.io22.84GB2026-07-21 03:15
159

docker.io/vllm/vllm-openai:latest

linux/amd64 docker.io10.24GB2024-10-11 00:43
12249

docker.io/vllm/vllm-openai:latest

linux/arm64 docker.io20.65GB2026-02-08 00:59
916

docker.io/vllm/vllm-openai:latest-cu129

linux/amd64 docker.io24.27GB2026-08-11 01:48
239

docker.io/vllm/vllm-openai:latest-cu129-ubuntu2404

linux/amd64 docker.io26.67GB2026-05-09 02:37
636

docker.io/vllm/vllm-openai:latest-cu130

linux/amd64 docker.io19.65GB2026-03-31 00:47
1559

docker.io/vllm/vllm-openai:latest-ubuntu2404

linux/arm64 docker.io24.20GB2026-05-14 01:40
254

docker.io/vllm/vllm-openai:latest-x86_64-cu129-ubuntu2404

linux/amd64 docker.io30.16GB2026-06-03 05:05
588

docker.io/vllm/vllm-openai:mimo-v26

linux/amd64 docker.io21.64GB2026-09-24 01:45
38

docker.io/vllm/vllm-openai:mimov25-cu129

linux/amd64 docker.io27.47GB2026-05-01 01:00
763

docker.io/vllm/vllm-openai:minimax-m3

linux/amd64 docker.io18.60GB2026-06-14 00:53
406

docker.io/vllm/vllm-openai:minimax27

linux/amd64 docker.io24.06GB2026-04-14 01:09
693

docker.io/vllm/vllm-openai:muse-glimmer

linux/amd64 docker.io19.81GB2026-08-15 05:38
128

docker.io/vllm/vllm-openai:nightly

linux/amd64 docker.io18.74GB2025-12-03 02:43
4501
306
372
684
876
152
379
667
317
75
671
590
308

docker.io/vllm/vllm-openai:qwen3_5

linux/amd64 docker.io20.93GB2026-02-25 01:18
1985

docker.io/vllm/vllm-openai:qwen3_5-cu130

linux/amd64 docker.io19.60GB2026-04-11 00:51
731

docker.io/vllm/vllm-openai:qwen3_5-x86_64-cu129

linux/amd64 docker.io20.93GB2026-02-27 00:33
961

docker.io/vllm/vllm-openai:qwen38

linux/amd64 docker.io15.11GB2026-08-17 15:14
373

docker.io/vllm/vllm-openai:qwen38-cu129

linux/amd64 docker.io19.53GB2026-08-16 00:42
357

docker.io/vllm/vllm-openai:qwen38-flash-next

linux/amd64 docker.io19.84GB2026-08-28 02:43
448

docker.io/vllm/vllm-openai:qwen38-flash-next-x86_64-cu129

linux/amd64 docker.io24.23GB2026-08-28 00:49
235

docker.io/vllm/vllm-openai:qwen38-x86_64-cu129

linux/amd64 docker.io19.53GB2026-09-17 01:09
78

docker.io/vllm/vllm-openai:qwen38-x86_64-cu130

linux/amd64 docker.io15.11GB2026-08-18 00:29
238

docker.io/vllm/vllm-openai:stepfun37

linux/amd64 docker.io23.87GB2026-06-05 02:47
312

docker.io/vllm/vllm-openai:stepfun37-arm64-cu130

linux/arm64 docker.io25.79GB2026-06-06 01:02
175

docker.io/vllm/vllm-openai:unlimited-ocr

linux/amd64 docker.io18.61GB2026-06-29 04:32
753

docker.io/vllm/vllm-openai:unlimited-ocr-cu129

linux/amd64 docker.io24.19GB2026-07-07 01:23
278

docker.io/vllm/vllm-openai:v0.10.0

linux/amd64 docker.io26.13GB2025-07-26 03:15
2726

docker.io/vllm/vllm-openai:v0.10.1

linux/amd64 docker.io20.25GB2025-08-20 03:05
1837

docker.io/vllm/vllm-openai:v0.10.1.1

linux/amd64 docker.io20.26GB2025-08-23 01:43
2961

docker.io/vllm/vllm-openai:v0.10.2

linux/amd64 docker.io22.49GB2025-09-16 03:40
2385

docker.io/vllm/vllm-openai:v0.10.2-x86_64

linux/amd64 docker.io22.49GB2025-10-09 02:22
874

docker.io/vllm/vllm-openai:v0.11.0

linux/amd64 docker.io25.86GB2025-10-09 11:24
3408

docker.io/vllm/vllm-openai:v0.11.0

linux/arm64 docker.io24.17GB2025-10-30 00:47
1459

docker.io/vllm/vllm-openai:v0.11.0-x86_64

linux/amd64 docker.io25.86GB2025-10-09 02:14
3063

docker.io/vllm/vllm-openai:v0.11.1

linux/amd64 docker.io28.72GB2025-11-21 01:03
1096

docker.io/vllm/vllm-openai:v0.11.1

linux/arm64 docker.io26.54GB2025-11-22 01:23
727

docker.io/vllm/vllm-openai:v0.11.2

linux/amd64 docker.io28.82GB2025-11-22 00:46
2523

docker.io/vllm/vllm-openai:v0.11.2

linux/arm64 docker.io26.54GB2025-11-22 04:06
916

docker.io/vllm/vllm-openai:v0.12.0

linux/amd64 docker.io19.47GB2025-12-05 03:59
5433

docker.io/vllm/vllm-openai:v0.12.0-aarch64

linux/arm64 docker.io17.89GB2025-12-05 03:12
1454

docker.io/vllm/vllm-openai:v0.13.0

linux/amd64 docker.io19.51GB2026-01-22 01:41
3084

docker.io/vllm/vllm-openai:v0.13.0

linux/arm64 docker.io17.98GB2026-03-11 03:52
410

docker.io/vllm/vllm-openai:v0.14.0

linux/amd64 docker.io19.66GB2026-01-22 03:16
1020

docker.io/vllm/vllm-openai:v0.14.0

linux/arm64 docker.io20.19GB2026-03-17 02:20
463

docker.io/vllm/vllm-openai:v0.14.1

linux/amd64 docker.io19.69GB2026-01-27 01:52
1195
检测到您正在使用广告拦截插件,本站为公益站点,依赖广告维持运转 🙏 查看如何关闭 ×