NVIDIA
NVIDIA
TensorRT LLM Release
Container
NVIDIA
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
TRT_LLM_GIT_COMMIT=26f413ad9004bf4611b12c7aa15aed7897b720fb TRT_LLM_VERSION=1.1.0rc0
08/15/2025 8:59 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
TRT_LLM_VER=1.1.0rc0
08/15/2025 8:59 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
GIT_COMMIT=26f413ad9004bf4611b12c7aa15aed7897b720fb
08/15/2025 8:59 AM UTC
sha256:24481810a000c518584eb9efb764d636554f63d477935db78c1d5bb6a4166261RUN
SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
  rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
  rm -rf /root/.cache/pip
08/15/2025 8:59 AM UTC
sha256:3480cbab6b65e4a1a7013337b1f808f41fa6ada2b5556426e9a084ff21d85749COPY
examples examples
08/15/2025 8:59 AM UTC
sha256:f8dfdab1441f7cc59dcf5d82e7c88094127b41c5bd22ccbbb38320a169dda290COPY
/src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
08/15/2025 8:59 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
08/15/2025 8:59 AM UTC
sha256:2d34d1238e397c94552bdd53e26fd34374e63cc2006c11cbce20f7102f55fffdCOPY
/src/tensorrt_llm/benchmarks benchmarks
08/15/2025 8:59 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
SRC_DIR=/src/tensorrt_llm
08/15/2025 8:59 AM UTC
sha256:536de74c96c7d22d2f8b5833da5b40980555bdbb2714d72869a68a37d15489eeRUN
/bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
  test -f bin/executorWorker &&
  ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig &&
  ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
08/15/2025 8:59 AM UTC
...