NVIDIA
TensorRT LLM Develop
Container
NVIDIA
TensorRT LLM Develop

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

  • LayerLabelCreated
    sha256:e7f2c856c23c7a878bc2b999744443278385972d0d885e5b5c131d0066351819RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip TRT_LLM_VER=1.3.0rc15 TARGETARCH=amd64 /bin/bash -c bash /tmp/gen_attribution.sh "devel" "${TRT_LLM_VER}" "${TARGETARCH}"
    05/20/2026 7:56 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TARGETARCH=amd64
    05/20/2026 7:56 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TRT_LLM_VER=1.3.0rc15
    05/20/2026 7:56 AM UTC
    sha256:ec5a88ebc84009b55c35ae2fabf77befb4e6ea5938a736f83223bc52d7962deaRUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_ucx.sh &&
      GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_nixl.sh &&
      bash /opt/docker/common/install_etcd.sh &&
      rm -rf /root/.cache/uv/archive-v0 &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/jaraco.context-5.3.0.dist-info &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/wheel-*.dist-info
    05/20/2026 7:56 AM UTC
    sha256:2ee100eca18e1b1253b43448690d7a8df36459266ea959367ee5d7d5c5531a63RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c pip3 uninstall -y tornado black nbconvert pillow nvidia-cutlass-dsl nvidia-cutlass-dsl-libs-base numpy ||
      true &&
      rm -rf $(python3 -c "import site; print(site.getsitepackages()[0])")/nvidia_cutlass_dsl* &&
      pip3 install --ignore-installed -r /tmp/constraints.txt &&
      rm /tmp/constraints.txt
    05/20/2026 7:52 AM UTC
    sha256:602f15f0dd916870485a6ed4e18b54d133fe8cdd3468db17f3f7e35f42de8a7aCOPY
    constraints.txt /tmp/constraints.txt
    05/20/2026 7:48 AM UTC
    sha256:2c63f4015bbd0ef897e6cd405ee898954f3bf7d79281ae412ddddb841a85c0eaRUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c echo "Using GitHub mirror: ${GITHUB_MIRROR}" &&
      echo "Using Python version: ${PYTHON_VERSION}" &&
      GITHUB_MIRROR=${GITHUB_MIRROR} PYTHON_VERSION=${PYTHON_VERSION} TRT_VER=${TRT_VER} CUDA_VER=${CUDA_VER} CUDNN_VER=${CUDNN_VER} NCCL_VER=${NCCL_VER} CUBLAS_VER=${CUBLAS_VER} TORCH_INSTALL_TYPE=${TORCH_INSTALL_TYPE} bash /opt/docker/common/install.sh --base --cmake --ccache --cuda_toolkit --tensorrt --polygraphy --mpi4py --pytorch --opencv
    05/20/2026 7:48 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TORCH_INSTALL_TYPE=skip
    05/20/2026 7:41 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    CUBLAS_VER
    05/20/2026 7:41 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    NCCL_VER
    05/20/2026 7:41 AM UTC
    ...