NVIDIA
NVIDIA
TensorRT Inference Server
Container
NVIDIA
NVIDIA
TensorRT Inference Server

TensorRT Inference Server provides a data center inference solution optimized for NVIDIA GPUs. It maximizes inference utilization and performance on GPUs via an HTTP or gRPC endpoint, allowing remote clients to request inference for any model that is being managed by the server, as well as providing real-time metrics on latency and requests.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4LABEL
com.nvidia.build.ref=cde64366ae7eab4e0347df7c8ed44398f3f76616
11/07/2018 6:04 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
NVIDIA_BUILD_REF
11/07/2018 6:04 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4LABEL
com.nvidia.build.id=829351
11/07/2018 6:04 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
NVIDIA_BUILD_ID=829351
11/07/2018 6:04 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ARG
NVIDIA_BUILD_ID
11/07/2018 6:04 PM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
/opt/tensorrtserver/nvidia_entrypoint.sh
11/07/2018 6:04 PM UTC
sha256:2f26a712d8fd6435d08061e7eb5ec1fa5749c43ab5a0684fc125b11f5c976d44COPY
file:efee072d36828f125fc5a39ae63dbaba3b9b4547bda7963a5be81c1a936b5661 in /opt/tensorrtserver
11/07/2018 6:04 PM UTC
sha256:1b2f4355a5c49834d068181c26ac91cfc03d0bf0d5d7ef743da3e4b2b812902eCOPY
dir:d0b3b0bfd92061d4fad321939f871c9f4998abbf47a9ecf7b21e75780538d244 in lib
11/07/2018 6:04 PM UTC
sha256:a87c09fc6680ed3a5a39ab5f766cb26f1ffe00cfa742661ad7593b63748c7264COPY
file:01ce3841628e636d84e58b37ec0fb3f6b8143d00784505cc977c2075ee000065 in bin/
11/07/2018 6:04 PM UTC
sha256:f33bb8e463b7a9bcc55edc1cae9e1e7198e872af3c0fe4e17330556e4f5af7ddCOPY
file:5e666f796155692be498d908c47ae8d144319cd37ff7987c2f8d8fb640ef2cd7 in LICENSE.pytorch
11/07/2018 6:03 PM UTC