NVIDIA
NVIDIA
TensorRT LLM Develop
Container
NVIDIA
NVIDIA
TensorRT LLM Develop

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

  • LayerLabelCreated
    sha256:5f82fdfa627ac9161f857577311e143cbdc0c7a6c44bfb58fe000443b013610aRUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip TRT_LLM_VER=1.3.0rc13 TARGETARCH=amd64 /bin/bash -c bash /tmp/gen_attribution.sh "devel" "${TRT_LLM_VER}" "${TARGETARCH}"
    04/26/2026 3:56 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TARGETARCH=amd64
    04/26/2026 3:56 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TRT_LLM_VER=1.3.0rc13
    04/26/2026 3:56 AM UTC
    sha256:53ff45cf02ef8aa067e8baa1c78927a6657a0d29ae30348379f7a352aac2a674RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_ucx.sh &&
      GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_nixl.sh &&
      bash /opt/docker/common/install_etcd.sh &&
      rm -rf /root/.cache/uv/archive-v0 &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/jaraco.context-5.3.0.dist-info &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/wheel-*.dist-info
    04/26/2026 3:56 AM UTC
    sha256:ddb4a5c844396e0beabb62b5be9a2b9b440aeb35e0e69d153307d691cf89ea61RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c pip3 uninstall -y tornado black nbconvert pillow ||
      true &&
      pip3 install --ignore-installed --no-cache-dir -r /tmp/constraints.txt &&
      rm /tmp/constraints.txt
    04/26/2026 3:47 AM UTC
    sha256:c10489b485e6348ab9d9df58ee831fe28b8683138cd10ef6d10a854fba55db92COPY
    constraints.txt /tmp/constraints.txt
    04/26/2026 3:36 AM UTC
    sha256:9477a6b485b510954e50d3e7bffbdead8bd86b9d4e219fdd8526485d8ba957c1RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c echo "Using GitHub mirror: ${GITHUB_MIRROR}" &&
      echo "Using Python version: ${PYTHON_VERSION}" &&
      GITHUB_MIRROR=${GITHUB_MIRROR} PYTHON_VERSION=${PYTHON_VERSION} TRT_VER=${TRT_VER} CUDA_VER=${CUDA_VER} CUDNN_VER=${CUDNN_VER} NCCL_VER=${NCCL_VER} CUBLAS_VER=${CUBLAS_VER} TORCH_INSTALL_TYPE=${TORCH_INSTALL_TYPE} bash /opt/docker/common/install.sh --base --cmake --ccache --cuda_toolkit --tensorrt --polygraphy --mpi4py --pytorch --opencv
    04/26/2026 3:36 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TORCH_INSTALL_TYPE=skip
    04/26/2026 3:31 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    CUBLAS_VER
    04/26/2026 3:31 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    NCCL_VER
    04/26/2026 3:31 AM UTC
    ...