NVIDIA
NVIDIA
TensorRT LLM Release
Container
NVIDIA
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
TRT_LLM_GIT_COMMIT=8505c3ad88e75c511b880dce998c0ea862802bd4 TRT_LLM_VERSION=1.1.0rc3
10/01/2025 8:23 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
TRT_LLM_VER=1.1.0rc3
10/01/2025 8:23 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
GIT_COMMIT=8505c3ad88e75c511b880dce998c0ea862802bd4
10/01/2025 8:23 PM UTC
sha256:2ce65807252474918933350df3df10fbf356ec2c715f961e94537c09daa7707aRUN
SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
  rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
  rm -rf /root/.cache/pip
10/01/2025 8:23 PM UTC
sha256:160833afa649a6bff63caa9f0d6628323966e3bd3f93c1b8796940bc6c9aa49bCOPY
examples examples
10/01/2025 8:23 PM UTC
sha256:b5964b7e325afbff7e92d047f5f2b79121cb0a30714338786a78464a8183e410COPY
/src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
10/01/2025 8:23 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
10/01/2025 8:23 PM UTC
sha256:be6a49289d0d6c915d42da458c09b3e92ee0b83ffeb4d93ebce3d5a2ea4effa8COPY
/src/tensorrt_llm/benchmarks benchmarks
10/01/2025 8:23 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
SRC_DIR=/src/tensorrt_llm
10/01/2025 8:23 PM UTC
sha256:b719778e4e954b4243e38cbc6bd46311694f40466e5c7ae609afcff3756acc3eRUN
/bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
  test -f bin/executorWorker &&
  ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig &&
  ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
10/01/2025 8:23 PM UTC
...