NVIDIA
NVIDIA
ModelExpress Server
Container
NVIDIA
NVIDIA
ModelExpress Server

Model Express is a Rust-based model cache management service designed to be deployed as a sidecar alongside existing inference solutions such as NVIDIA Dynamo.

ModelExpress-server is a container providing a model cache management service designed to be deployed as a sidecar alongside existing inference solutions such as NVIDIA Dynamo.

Publisher
NVIDIA
NVIDIA
Latest Tag0.5.0
UpdatedAugust 1, 2026 UTC
Compressed Size71.2 MB
Multinode SupportNo
Multi-Arch SupportYes