NVIDIA
NVIDIA
TensorRT LLM Release
Container
NVIDIA
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
TRT_LLM_GIT_COMMIT=9ae2ce6665539a4c40a3e87eff63eac85cd773a7 TRT_LLM_VERSION=0.21.0rc0
06/04/2025 5:24 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
TRT_LLM_VER=0.21.0rc0
06/04/2025 5:24 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
GIT_COMMIT=9ae2ce6665539a4c40a3e87eff63eac85cd773a7
06/04/2025 5:24 AM UTC
sha256:c9bb3b24e93d1672fa8fd7908196f0ff4b7c670f79feaea90ad43da37e6885feRUN
SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
  rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
  rm -rf /root/.cache/pip
06/04/2025 5:24 AM UTC
sha256:73f95f48b5c51cc033c750a32a276b8a7e5b51a4132cfb21fdd6adaacec2e147COPY
examples examples
06/04/2025 5:24 AM UTC
sha256:cf982372f507a30dfbb2163d97dffa3d775f85afb0670f11ad1c69e3ae30785aCOPY
/src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
06/04/2025 5:24 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
06/04/2025 5:24 AM UTC
sha256:4ffeb1868855420237ddbd32317f628a93baa272158eb90beb5a05a7acc49dd4COPY
/src/tensorrt_llm/benchmarks benchmarks
06/04/2025 5:24 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
SRC_DIR=/src/tensorrt_llm
06/04/2025 5:24 AM UTC
sha256:bbd2654c3acbe89a28370264e13f7ca383a22d3495f5a06f21eca360f2f406f3RUN
/bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
  test -f bin/executorWorker &&
  ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig &&
  ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
06/04/2025 5:24 AM UTC
...