NVIDIA
GPT-OSS-20B
Container
NVIDIA
GPT-OSS-20B

NVIDIA NIM for GPU accelerated GPT-OSS-20B Model inference through OpenAI compatible APIs

  • LayerLabelCreated
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
    ["/bin/bash" "/opt/nim/start_server.sh"]
    02/26/2026 2:47 AM UTC
    sha256:e48f09b8041856a6d759f0fbad56de78436e3ed2c3c6a698dc6a293401c183fdCOPY
    --chmod=755 ./entrypoint.sh /opt/nim/start_server.sh
    02/26/2026 2:47 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    SERVER_START_SCRIPT_PATH=/opt/nim/start_server.sh
    02/26/2026 2:47 AM UTC
    sha256:119a5f145354dd3530647fb43b5e2a21fd46617954ce566e0ff5809808fbebb2COPY
    model_manifest.yaml /opt/nim/etc/default/model_manifest.yaml
    02/26/2026 2:47 AM UTC
    sha256:b58a342e541217a9f327ba6935d677ca48941bdc111efaab5dcebc98e00c51efRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple mkdir -p $TIKTOKEN_ENCODINGS_BASE &&
      curl -L -o $TIKTOKEN_ENCODINGS_BASE/o200k_base.tiktoken "https://openaipublic.blob.core.windows.net/encodings/o200k_base.tiktoken" &&
      curl -L -o $TIKTOKEN_ENCODINGS_BASE/cl100k_base.tiktoken "https://openaipublic.blob.core.windows.net/encodings/cl100k_base.tiktoken" &&
      chmod 755 $TIKTOKEN_ENCODINGS_BASE &&
      chmod 644 $TIKTOKEN_ENCODINGS_BASE/*.tiktoken
    02/26/2026 2:47 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    TIKTOKEN_ENCODINGS_BASE=/opt/nim/encodings
    02/26/2026 2:47 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4USER
    nvs:1000
    02/26/2026 2:47 AM UTC
    sha256:2fff69d86fba59a2e201d6257c2d80099e092d99b198409fa0cce8b9ebdb69a5RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple [ -d /etc/ld.so.conf.d ] ||
      mkdir -p /etc/ld.so.conf.d &&
      [ -f /etc/ld.so.conf.d/nvidia.conf ] ||
      touch /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      if command -v ldconfig >/dev/null 2>&1; then ldconfig; fi
    02/26/2026 2:47 AM UTC
    sha256:f6df4c7344929a231c31e35732e852db1c5d03fef39aa71b0e18ef5b90add1dcRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple groupadd --gid 1000 --non-unique nvs &&
      useradd --create-home --shell /usr/sbin/nologin --uid 1000 --non-unique --gid 1000 nvs &&
      mkdir -p $NIM_CACHE_PATH &&
      chown -R 1000:1000 $NIM_DIR_PATH $NIM_CACHE_PATH
    02/26/2026 2:47 AM UTC
    sha256:0eb6f8f5b6b04f4dfbe0ef3b58170d9de4296a2a130dd205a0b666e19d1963edRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple patch /usr/local/lib/python3.12/dist-packages/nimlib/profiles.py < /tmp/patches/nimlib/profiles.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/llm/profile_selection.py < /tmp/patches/nimlib/profile_selection.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/download.py < /tmp/patches/nimlib/download.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/custom_error_models.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/start_server_banner.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/standard_files_banner_log.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/vllm/entrypoints/openai < /tmp/patches/vllm/protocol_validation.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/config_offline.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/inference_engine.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/backends/vllm_backend.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/api/vllm.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/lora_bw.patch &&
      patch /usr/local/lib/python3.12/dist-packages/vllm/entrypoints/harmony_utils.py < /tmp/patches/vllm/harmony_utils_channel.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/tool_choice_none.patch &&
      rm -rf /tmp/patches
    02/26/2026 2:47 AM UTC
    ...