Sign inSign up

vllm/vime:nightly-dev-20260715c

Multi-platform
Index digest

sha256:267dab8accfcdbbb31aa09ce8b74a31e13a9aaec3d7968164b3dad7ae865dd2c

OS/ARCH

Compressed size

13.78 GB

Last pushed

2 months by vllm

Type

Image

Manifest digest

sha256:22a381ad272ea75a491cd20e1405d78361b05da72d7d97aee3a37ff8e059a851

Image Layers

1ARG RELEASE0 B
2ARG LAUNCHPAD_BUILD_ARCH0 B
3LABEL org.opencontainers.image.ref.name=ubuntu0 B
4LABEL org.opencontainers.image.version=24.040 B
5ADD file ... in / 28.55 MB
6CMD ["/bin/bash"]0 B
7ENV NVARCH=sbsa0 B
8ENV NVIDIA_REQUIRE_CUDA=cuda>=13.0 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<5360 B
9ENV NV_CUDA_CUDART_VERSION=13.0.96-10 B
10ARG TARGETARCH0 B
11LABEL maintainer=NVIDIA CORPORATION <[email protected]>0 B
12RUN |1 TARGETARCH=arm64 /bin/sh -c4.32 MB
13ENV CUDA_VERSION=13.0.20 B
14RUN |1 TARGETARCH=arm64 /bin/sh -c95.11 MB
15RUN |1 TARGETARCH=arm64 /bin/sh -c186 B
16ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B
17ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
18COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB
19ENV NVIDIA_VISIBLE_DEVICES=all0 B
20ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B
21ARG CUDA_VERSION0 B
22ARG PYTHON_VERSION0 B
23ARG DEADSNAKES_MIRROR_URL0 B
24ARG DEADSNAKES_GPGKEY_URL0 B
25ARG GET_PIP_URL0 B
26ENV DEBIAN_FRONTEND=noninteractive0 B
27WORKDIR /vllm-workspace104 B
28RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=230 B
29RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=215.93 MB
30RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.81 GB
31RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=49.78 MB
32ENV UV_HTTP_TIMEOUT=5000 B
33ENV UV_INDEX_STRATEGY=unsafe-best-match0 B
34ENV UV_LINK_MODE=copy0 B
35ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python0 B
36ENV UV_CACHE_DIR=/opt/uv/cache0 B
37RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=149 B
38RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=3.62 KB
39COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit2.04 KB
40RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=2.04 KB
41ENV VLLM_ENABLE_CUDA_COMPATIBILITY=00 B
42ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
43COPY requirements/common.txt /tmp/common.txt # buildkit1.64 KB
44COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit734 B
45RUN |6 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=3.72 GB
46ARG FLASHINFER_VERSION=0.6.130 B
47RUN |7 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.63 GB
48ARG GDRCOPY_CUDA_VERSION=12.80 B
49ARG GDRCOPY_OS_VERSION=Ubuntu22_040 B
50ARG TARGETPLATFORM0 B
51COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit896 B
52RUN |10 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=519.08 KB
53ARG BITSANDBYTES_VERSION_X86=0.46.10 B
54ARG BITSANDBYTES_VERSION_ARM64=0.42.00 B
55ARG TIMM_VERSION=>=1.0.170 B
56ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.70 B
57RUN |14 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=300.25 MB
58ARG PIP_INDEX_URL UV_INDEX_URL0 B
59ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
60ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
61ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER0 B
62ARG PYTORCH_NIGHTLY0 B
63COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit198 B
64COPY /workspace/dist/wheel.sha256 /tmp/vllm-wheel.sha256 # buildkit227 B
65RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=438.24 MB
66RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=32 B
67ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
68COPY /tmp/ep_kernels_workspace/dist/wheels.sha256 /tmp/ep-kernels-wheels.sha256 # buildkit253 B
69RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=10.8 MB
70RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=78.79 MB
71ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
72COPY examples examples # buildkit260.29 KB
73COPY benchmarks benchmarks # buildkit249.7 KB
74COPY ./vllm/collect_env.py . # buildkit9.62 KB
75ARG TARGETPLATFORM0 B
76ARG INSTALL_KV_CONNECTORS=false0 B
77ARG CUDA_VERSION0 B
78ARG VLLM_BUILD_COMMIT0 B
79ARG VLLM_BUILD_PIPELINE0 B
80ARG VLLM_BUILD_URL0 B
81ARG VLLM_IMAGE_TAG0 B
82ARG PIP_INDEX_URL UV_INDEX_URL0 B
83ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
84ENV UV_HTTP_TIMEOUT=5000 B
85ARG torch_cuda_arch_list=7.5 8.0 8.6 8.90 B
86ENV TORCH_CUDA_ARCH_LIST=8.0 8.7 8.9 9.00 B
87RUN |12 TARGETPLATFORM=linux/arm64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2814.83 MB
88ARG MOONCAKE_WHEEL_AARCH640 B
89ARG MOONCAKE_WHEEL_X86_640 B
90RUN |14 TARGETPLATFORM=linux/arm64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2425.37 MB
91ENV VLLM_USAGE_SOURCE=production-docker-image0 B
92ENV VLLM_BUILD_COMMIT=752a3a504485790a2e8491cacbb35c137339ad34 VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/3803 VLLM_IMAGE_TAG=vllm/vllm-openai:v0.25.1-ubuntu24040 B
93LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=752a3a504485790a2e8491cacbb35c137339ad34 org.opencontainers.image.version=vllm/vllm-openai:v0.25.1-ubuntu2404 org.opencontainers.image.url=https://buildkite.com/vllm/release-v2/builds/38030 B
94ENTRYPOINT ["vllm" "serve"]0 B
95ARG PATCH_VERSION=latest0 B
96ARG MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e0870 B
97ARG ENABLE_CUDA_13=10 B
98ARG FA2_MAX_JOBS=320 B
99WORKDIR /root/32 B
100RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=11.43 GB
101RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1174 B
102RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=181.89 KB
103RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1465.46 MB
104RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1378.83 MB
105RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=11.6 MB
106RUN |4 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=12.72 MB
107ARG INSTALL_FLASHQLA=10 B
108RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1211.88 KB
109RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=132 B
110RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1605.24 MB
111RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1253.73 MB
112RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=147.75 MB
113RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1122.51 MB
114RUN |5 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1366.62 KB
115ARG MEGATRON_BRIDGE_COMMIT=07d61e1547a8356cc34928f7eb20226d2f9db3fa0 B
116RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=169.33 MB
117COPY docker/patch/latest/megatron_bridge.patch /root/Megatron-Bridge/ # buildkit643 B
118RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=154.19 MB
119RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1112.62 MB
120COPY requirements.txt /tmp/requirements.txt # buildkit443 B
121RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1492.58 MB
122RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=132 B
123RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1101.88 MB
124RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1152 B
125COPY docker/patch/latest/megatron.patch /root/Megatron-LM/ # buildkit11.16 KB
126RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=1113.03 MB
127COPY docker/patch/latest/vllm.patch /tmp/vllm.patch # buildkit2.52 KB
128RUN |6 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=114.64 MB
129ARG VIME_COMMIT=6cefd8463f7fa6b80b6692175975d91975f6bd3c0 B
130RUN |7 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=121 MB
131RUN |7 PATCH_VERSION=latest MEGATRON_COMMIT=1dcf0dafa884ad52ffb243625717a3471643e087 ENABLE_CUDA_13=11.43 MB
132ENTRYPOINT []0 B
133CMD ["/bin/bash"]0 B

Command

 ARG RELEASE