Skip to main content
NVIDIA
TensorRT LLM Release
Container
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

  • LayerLabelCreated
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    TRT_LLM_GIT_COMMIT=7965842954628b0b5456a2f7d59786d3dcd41647 TRT_LLM_VERSION=0.20.0
    06/18/2025 9:39 PM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    TRT_LLM_VER=0.20.0
    06/18/2025 9:39 PM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    GIT_COMMIT=7965842954628b0b5456a2f7d59786d3dcd41647
    06/18/2025 9:39 PM UTC
    sha256:1a9c1717c37f3506b7a803dd67e87f5fad5b2bc0c052634a57513f46e2a530d4RUN
    SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
      rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
      rm -rf /root/.cache/pip
    06/18/2025 9:39 PM UTC
    sha256:ae3344967a2a0db1d766930327570833e6c16f2d94d8ec830ebc08bed846fcb1COPY
    examples examples
    06/18/2025 9:39 PM UTC
    sha256:aa58597a7ab5312570263d90a24150826c0c18c5eb7fdb4d705f670a8e0f31e4COPY
    /src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
    06/18/2025 9:39 PM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
    06/18/2025 9:39 PM UTC
    sha256:f7fae9a993211d9b59821877f21e41ff1d77f46842cdd5f288623d5b8d2628ddCOPY
    /src/tensorrt_llm/benchmarks benchmarks
    06/18/2025 9:39 PM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
    SRC_DIR=/src/tensorrt_llm
    06/18/2025 9:39 PM UTC
    sha256:11c8d933cfe066b39a2b6ca67aef3a59f477bd0f395bf32354c9c00c5a7e4983RUN
    /bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
      test -f bin/executorWorker &&
      ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
      test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
      echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
      ldconfig &&
      ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
    06/18/2025 9:39 PM UTC
    ...