NVIDIA
GPT-OSS-20B
Container
NVIDIA
GPT-OSS-20B

NVIDIA NIM for GPU accelerated GPT-OSS-20B Model inference through OpenAI compatible APIs

  • LayerLabelCreated
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
    ["/bin/bash" "/opt/nim/start_server.sh"]
    12/01/2025 3:18 AM UTC
    sha256:6cac0cd5f407600ae4da79f421e813d82442cb613bf59150f965c6b8e15ebd7aCOPY
    --chmod=755 ./entrypoint.sh /opt/nim/start_server.sh
    12/01/2025 3:18 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    SERVER_START_SCRIPT_PATH=/opt/nim/start_server.sh
    12/01/2025 3:18 AM UTC
    sha256:b45cfba332c284d17750ead8789beb9fb8bdd73c6cbd09d68a9d378de8dc7e47COPY
    model_manifest.yaml /opt/nim/etc/default/model_manifest.yaml
    12/01/2025 3:18 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4USER
    nvs:1000
    12/01/2025 3:18 AM UTC
    sha256:a56c69ff205714d8ab0ca60f5ef943aec530ea034cb3865b41c45a4dd2e9fefdRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple [ -d /etc/ld.so.conf.d ] ||
      mkdir -p /etc/ld.so.conf.d &&
      [ -f /etc/ld.so.conf.d/nvidia.conf ] ||
      touch /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      if command -v ldconfig >/dev/null 2>&1; then ldconfig; fi
    12/01/2025 3:18 AM UTC
    sha256:0e65a834490463b60ee2a1a820490f414ce2fbfd2aa0a5bb5bb2a9b930d02ddeRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple groupadd --gid 1000 --non-unique nvs &&
      useradd --create-home --shell /usr/sbin/nologin --uid 1000 --non-unique --gid 1000 nvs &&
      chown 1000.1000 $NIM_DIR_PATH
    12/01/2025 3:18 AM UTC
    sha256:cbd6b48e047db95c29be807032d51c71eb9e38bf3bb73216564abd275bf74c20RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple patch /usr/local/lib/python3.12/dist-packages/nimlib/profiles.py < /tmp/patches/nimlib/profiles.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/llm/profile_selection.py < /tmp/patches/nimlib/profile_selection.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/download.py < /tmp/patches/nimlib/download.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/custom_error_models.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/start_server_banner.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/api_validation_error.patch &&
      patch /workspace/vllm-source/vllm/entrypoints/openai/serving_chat.py < /tmp/patches/vllm/serving_chat_v7.patch &&
      patch -p0 -d /workspace/vllm-source/vllm/entrypoints/openai < /tmp/patches/vllm/protocol_validation.patch &&
      patch -p1 -d /workspace/vllm-source < /tmp/patches/vllm/config_offline.patch &&
      patch -p1 -d /workspace/vllm-source < /tmp/patches/vllm/metrics_rename.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nim_inference_sdk/inference_engine.py < /tmp/patches/nim_inference_sdk/inference_engine.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/backends/vllm_backend.patch &&
      rm -rf /tmp/patches
    12/01/2025 3:18 AM UTC
    sha256:38777ad88a1a8d3a98f2c76498cc2815a0d0eff15347ddb9c982fc6d63681833COPY
    ./patches /tmp/patches
    12/01/2025 3:18 AM UTC
    sha256:c30160a011c9a90d675b1b372421dfb43649c4f3b1053527eb70682019030901COPY
    ./banner.txt /opt/nim
    12/01/2025 3:18 AM UTC
    ...