NVIDIA
NVIDIA
GPT-OSS-120B
Container
NVIDIA
NVIDIA
GPT-OSS-120B

NVIDIA NIM for GPU accelerated GPT-OSS-120B Model inference through OpenAI compatible APIs

  • LayerLabelCreated
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
    ["/bin/bash" "/opt/nim/start_server.sh"]
    12/01/2025 3:17 AM UTC
    sha256:1fb40d392173f1a3f7707a80e6e455bac13858d301be6e1cb1e8c6919333547eCOPY
    --chmod=755 ./entrypoint.sh /opt/nim/start_server.sh
    12/01/2025 3:17 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    SERVER_START_SCRIPT_PATH=/opt/nim/start_server.sh
    12/01/2025 3:17 AM UTC
    sha256:03b6d8d9a46a5df8ff1c741003966e12d6c3a2331ad46e0a7f4049d8b6508347COPY
    model_manifest.yaml /opt/nim/etc/default/model_manifest.yaml
    12/01/2025 3:17 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4USER
    nvs:1000
    12/01/2025 3:17 AM UTC
    sha256:86f0fcf17e41d72e58f8b6942ae7c2f8e373780250574689c2b39653dcd4bb68RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple [ -d /etc/ld.so.conf.d ] ||
      mkdir -p /etc/ld.so.conf.d &&
      [ -f /etc/ld.so.conf.d/nvidia.conf ] ||
      touch /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      if command -v ldconfig >/dev/null 2>&1; then ldconfig; fi
    12/01/2025 3:17 AM UTC
    sha256:c5e60c41d1234805b16e964ec65b871dce7b0d1df1957fb917f4eb76cf0c5ab9RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple groupadd --gid 1000 --non-unique nvs &&
      useradd --create-home --shell /usr/sbin/nologin --uid 1000 --non-unique --gid 1000 nvs &&
      chown 1000.1000 $NIM_DIR_PATH
    12/01/2025 3:17 AM UTC
    sha256:06a30ecbd633e076b9927798ddc4b2bb7a4f7ffcce053e42b68d44832218c86aRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple patch /usr/local/lib/python3.12/dist-packages/nimlib/profiles.py < /tmp/patches/nimlib/profiles.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/llm/profile_selection.py < /tmp/patches/nimlib/profile_selection.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/download.py < /tmp/patches/nimlib/download.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/custom_error_models.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/start_server_banner.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/api_validation_error.patch &&
      patch /workspace/vllm-source/vllm/entrypoints/openai/serving_chat.py < /tmp/patches/vllm/serving_chat_v7.patch &&
      patch /workspace/vllm-source/vllm/sampling_params.py < /tmp/patches/vllm/sampling_params.patch &&
      patch -p0 -d /workspace/vllm-source/vllm/entrypoints/openai < /tmp/patches/vllm/protocol_validation.patch &&
      patch -p1 -d /workspace/vllm-source < /tmp/patches/vllm/config_offline.patch &&
      patch -p1 -d /workspace/vllm-source < /tmp/patches/vllm/metrics_rename.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/inference_engine.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/backends/vllm_backend.patch &&
      rm -rf /tmp/patches
    12/01/2025 3:17 AM UTC
    sha256:049287e8b804207f4bc89a8e938f609cf9370ae271897386b7718ae538e4d891COPY
    ./patches /tmp/patches
    12/01/2025 3:17 AM UTC
    sha256:da256403ea66e08118d5c511c3ac831d9e69c72e2d01ba240d7421277f89b591COPY
    ./banner.txt /opt/nim
    12/01/2025 3:17 AM UTC
    ...