NVIDIA
NVIDIA
TensorRT LLM Release
Container
NVIDIA
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
TRT_LLM_GIT_COMMIT=910c070e88366f7d9c7f8474fe080ada90eb4df3 TRT_LLM_VERSION=1.2.0rc2.post2
02/04/2026 5:21 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
TRT_LLM_VER=1.2.0rc2.post2
02/04/2026 5:21 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
GIT_COMMIT=910c070e88366f7d9c7f8474fe080ada90eb4df3
02/04/2026 5:21 AM UTC
sha256:2644d728ea5bd4c7ba2683624483088521b3ca9065350f4ee7467767274b47eeRUN
SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
  rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
  rm -rf /root/.cache/pip
02/04/2026 5:21 AM UTC
sha256:268397cc311b2c4a5cc399d8e139dd4d474c486181b69cc86ccc04dd542ef556COPY
examples examples
02/04/2026 5:20 AM UTC
sha256:7576dbdf80c0b508b31cbeb07164b657f52a3535cc6d5faa3e9c75d8f89faeedCOPY
/src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
02/04/2026 5:20 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
02/04/2026 5:20 AM UTC
sha256:4e1e6d198ae26a2e5f73bbcd543d0a220c1d3436e903686b3abacf5786a0af22COPY
/src/tensorrt_llm/benchmarks benchmarks
02/04/2026 5:20 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
SRC_DIR=/src/tensorrt_llm
02/04/2026 5:20 AM UTC
sha256:b7b1f253196a6f2bc06796b1939ae472c2d4fdba2bea88db4c9e7fdc61704ea3RUN
/bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
  test -f bin/executorWorker &&
  ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig &&
  ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
02/04/2026 5:20 AM UTC
...