NVIDIA
NVIDIA
TensorRT LLM Release
Container
NVIDIA
NVIDIA
TensorRT LLM Release

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
TRT_LLM_GIT_COMMIT=a16ba6445c61ed70e7aadfe787d6f316bb422652 TRT_LLM_VERSION=1.0.0rc6
08/07/2025 3:56 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
TRT_LLM_VER=1.0.0rc6
08/07/2025 3:56 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
GIT_COMMIT=a16ba6445c61ed70e7aadfe787d6f316bb422652
08/07/2025 3:56 AM UTC
sha256:37572900d487cb86fb6426186df5a14595460943ef2d640c17848a866d59522fRUN
SRC_DIR=/src/tensorrt_llm CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build /bin/bash -c chmod -R a+w examples &&
  rm -v benchmarks/cpp/bertBenchmark.cpp benchmarks/cpp/gptManagerBenchmark.cpp benchmarks/cpp/disaggServerBenchmark.cpp benchmarks/cpp/CMakeLists.txt &&
  rm -rf /root/.cache/pip
08/07/2025 3:56 AM UTC
sha256:76c05b2cfd02354a5cf8c3c482bd3b74c6049d2006a749fc6080c0dcfa990198COPY
examples examples
08/07/2025 3:56 AM UTC
sha256:51ffef3ad2af4d9ad7fe0ebadc39f50e702ae63b09a2acbe7f9570e48d41998aCOPY
/src/tensorrt_llm/cpp/build/benchmarks/bertBenchmark /src/tensorrt_llm/cpp/build/benchmarks/gptManagerBenchmark /src/tensorrt_llm/cpp/build/benchmarks/disaggServerBenchmark benchmarks/cpp/
08/07/2025 3:56 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
CPP_BUILD_DIR=/src/tensorrt_llm/cpp/build
08/07/2025 3:56 AM UTC
sha256:d776465095451933d30e2137345da4deb4b255c5d613583375d2b5d63f6a4471COPY
/src/tensorrt_llm/benchmarks benchmarks
08/07/2025 3:56 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
SRC_DIR=/src/tensorrt_llm
08/07/2025 3:56 AM UTC
sha256:6df32b18a26b016ec33b0ec36f8f4ee0220c40e059fe76fd7f11e7c84db7ee61RUN
/bin/bash -c ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/bin")') bin &&
  test -f bin/executorWorker &&
  ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig &&
  ! ( ldd -v bin/executorWorker | grep tensorrt_llm | grep -q "not found" )
08/07/2025 3:56 AM UTC
...