NVIDIA
TensorRT Inference Server
Container
NVIDIA
TensorRT Inference Server

TensorRT Inference Server provides a data center inference solution optimized for NVIDIA GPUs. It maximizes inference utilization and performance on GPUs via an HTTP or gRPC endpoint, allowing remote clients to request inference for any model that is being managed by the server, as well as providing real-time metrics on latency and requests.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4LABEL
com.nvidia.build.ref=e82388dc0813aab3c301371bdcbdc40a3ccb33f5
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
NVIDIA_BUILD_REF
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4LABEL
com.nvidia.build.id=10247880
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
NVIDIA_BUILD_ID=10247880
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
NVIDIA_BUILD_ID
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
/opt/tensorrtserver/nvidia_entrypoint.sh
02/18/2020 10:03 PM UTC
sha256:fcda33dadb6003dd219d412812f9ca0bda36b4112545ca0d9f57034b89e78381COPY
--chown=1000:1000file:f894ab75fd7380df5bdd020b60e778b96df3f14a43d41bc5a541919311d0cdfb in /opt/tensorrtserver
02/18/2020 10:03 PM UTC
sha256:240eecfafb66672af4baf20a16eee5e9b67c602e5767dcff00a74c5bf4f34e33RUN
TRTIS_CONTAINER_VERSION=20.02 TRTIS_VERSION=1.11.0 ln -sf ${_CUDA_COMPAT_PATH}/lib.real ${_CUDA_COMPAT_PATH}/lib &&
  echo ${_CUDA_COMPAT_PATH}/lib > /etc/ld.so.conf.d/00-cuda-compat.conf &&
  ldconfig &&
  rm -f ${_CUDA_COMPAT_PATH}/lib
02/18/2020 10:03 PM UTC
sha256:05c85e1f93d3acfb787a08d4459303ef5ec8cafcbc4667d7de1dbb64813ea35aRUN
TRTIS_CONTAINER_VERSION=20.02 TRTIS_VERSION=1.11.0 apt-get update &&
  apt-get install -y --no-install-recommends python3-pip &&
  rm -rf /var/lib/apt/lists/* &&
  pip3 install --upgrade wheel setuptools test-generator==0.1.1 &&
  (cd $INTEL_CVSDK_DIR/deployment_tools/model_optimizer &&
  pip3 install -r requirements_onnx.txt)
02/18/2020 10:03 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
PYTHONPATH=/opt/openvino_scripts:/opt/openvino_scripts/openvino_2019.3.376:/opt/openvino_scripts/openvino_2019.3.376/deployment_tools/model_optimizer:/opt/openvino_scripts/openvino_2019.3.376/tools:
02/18/2020 10:03 PM UTC
...