NVIDIA
TensorRT LLM Develop
Container
NVIDIA
TensorRT LLM Develop

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

  • LayerLabelCreated
    sha256:a3376484313bb1e93cd86ab2660fdc2bbf4828bc1c2a4eef9514c9259d109314RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip TRT_LLM_VER=1.3.0rc22.post1 TARGETARCH=amd64 /bin/bash -c bash /tmp/gen_attribution.sh "devel" "${TRT_LLM_VER}" "${TARGETARCH}"
    08/18/2026 6:17 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TARGETARCH=amd64
    08/18/2026 6:17 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TRT_LLM_VER=1.3.0rc22.post1
    08/18/2026 6:17 AM UTC
    sha256:df1c3579575c1523f3d27ad1c68777f232d534f0270628f5555f57e7b307026fRUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_ucx.sh &&
      GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_nixl.sh &&
      bash /opt/docker/common/install_etcd.sh &&
      GITHUB_MIRROR=${GITHUB_MIRROR} bash /opt/docker/common/install_fa4.sh &&
      rm -rf /root/.cache/uv/archive-v0 &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/jaraco.context-5.3.0.dist-info &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/wheel-*.dist-info
    08/18/2026 6:17 AM UTC
    sha256:abf4602a47c1729a23fa1de7e0af0e31f96d7556ab190cf57f94335433fc01f6RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c apt remove python3-wheel pip3 uninstall -y tornado black nbconvert pillow nvidia-cutlass-dsl nvidia-cutlass-dsl-libs-base numpy ||
      true &&
      rm -rf $(python3 -c "import site; print(site.getsitepackages()[0])")/nvidia_cutlass_dsl* &&
      pip3 install -r /tmp/constraints.txt &&
      rm /tmp/constraints.txt
    08/18/2026 6:14 AM UTC
    sha256:fc2e8ad71b89e15cd54471410de4cbff8e5072cc6ee8df3a71f4e6392966bc86COPY
    constraints.txt /tmp/constraints.txt
    08/18/2026 6:14 AM UTC
    sha256:f19b959912d3d15d61fa520e68580cb4b1bff80dcb25dab3d4a3c498d948d312RUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 TRT_VER= CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip /bin/bash -c echo "Using GitHub mirror: ${GITHUB_MIRROR}" &&
      echo "Using Python version: ${PYTHON_VERSION}" &&
      GITHUB_MIRROR=${GITHUB_MIRROR} PYTHON_VERSION=${PYTHON_VERSION} TRT_VER=${TRT_VER} CUDA_VER=${CUDA_VER} CUDNN_VER=${CUDNN_VER} NCCL_VER=${NCCL_VER} CUBLAS_VER=${CUBLAS_VER} TORCH_INSTALL_TYPE=${TORCH_INSTALL_TYPE} bash /opt/docker/common/install.sh --base --cmake --ccache --cuda_toolkit --tensorrt --polygraphy --mpi4py --pytorch
    08/18/2026 6:14 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TORCH_INSTALL_TYPE=skip
    08/18/2026 6:10 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    CUBLAS_VER
    08/18/2026 6:10 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    NCCL_VER
    08/18/2026 6:10 AM UTC
    ...