Skip to main content
NVIDIA
TensorRT LLM Release
Container
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

  • LayerLabelCreated
    sha256:8c80bf93027e194b97f01159718c955ee399537160cbb48976cd8527ca191911RUN
    GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote GIT_COMMIT=17803f6c0cbe8d9fed3ccf46a295b867e3493d3e TRT_LLM_VER=1.3.0rc26.dev202609050001 TARGETARCH=amd64 /bin/bash -c bash /mnt/gen_attribution.sh "release" "${TRT_LLM_VER}" "${TARGETARCH}"
    09/05/2026 12:25 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    TRT_LLM_GIT_COMMIT=17803f6c0cbe8d9fed3ccf46a295b867e3493d3e TRT_LLM_VERSION=1.3.0rc26.dev202609050001
    09/05/2026 12:25 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TARGETARCH=amd64
    09/05/2026 12:25 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TRT_LLM_VER=1.3.0rc26.dev202609050001
    09/05/2026 12:25 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    GIT_COMMIT=17803f6c0cbe8d9fed3ccf46a295b867e3493d3e
    09/05/2026 12:25 AM UTC
    sha256:d44ac4d43d6e6d75a46b22b00e3220204c4f5d4d4ba63d70cc06d476bbbdc05bRUN
    GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote /bin/bash -c cp /mnt/ctx/README.md ./ &&
      cp -r /mnt/ctx/docs ./docs &&
      cp -r /mnt/ctx/include ./include &&
      cp -r /mnt/ctx/examples ./examples &&
      chmod -R a+w examples &&
      cp /mnt/wheel/tensorrt_llm*.whl ./ &&
      ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
      test -f lib/libtensorrt_llm.so &&
      echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
      ldconfig &&
      ! ( ldd -v lib/libth_common.so | grep tensorrt_llm | grep -q "not found" ) &&
      rm -rf /root/.cache/uv/archive-v0 &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/jaraco.context-5.3.0.dist-info &&
      rm -rf /usr/local/lib/python3.12/dist-packages/setuptools/_vendor/wheel-0.45.1.dist-info
    09/05/2026 12:25 AM UTC
    sha256:5dec4826521c194ad0b5b82e56d30d4d43da7131e6515cecfdfaedd8a1c8a0c5RUN
    GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote /bin/bash -c if [ -n "$GITHUB_MIRROR" ]; then export PIP_INDEX_URL="https://urm.nvidia.com/artifactory/api/pypi/pypi-remote/simple"; fi &&
      TRTLLM_WHEEL=$(find /tmp/wheel -maxdepth 1 -name 'tensorrt_llm*.whl' -print -quit) &&
      test -n "${TRTLLM_WHEEL}" &&
      pip install "${TRTLLM_WHEEL}[mx]"
    09/05/2026 12:25 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote
    09/05/2026 12:25 AM UTC
    sha256:23ffdbbda25f2ed122af3c2a5a1f6f93359fd4644537d0fc456eb906f76543baWORKDIR
    /app/tensorrt_llm
    09/05/2026 12:23 AM UTC
    sha256:a46c682d1093a7ce27a0b4d95cf6cb726d93241865cb0ff8a51f817a143c791eRUN
    SH_ENV=/etc/shinit_v2 BASH_ENV=/etc/bash.bashrc GITHUB_MIRROR=https://urm.nvidia.com/artifactory/github-go-remote PYTHON_VERSION=3.12.3 CUDA_VER= CUDNN_VER= NCCL_VER= CUBLAS_VER= TORCH_INSTALL_TYPE=skip GIT_COMMIT=17803f6c0cbe8d9fed3ccf46a295b867e3493d3e TRT_LLM_VER=1.3.0rc26.dev202609050001 TARGETARCH=amd64 /bin/bash -c bash /tmp/gen_attribution.sh "devel" "${TRT_LLM_VER}" "${TARGETARCH}"
    09/05/2026 12:21 AM UTC
    ...