NVIDIA
NVIDIA
GPT-OSS-120B
Container
NVIDIA
NVIDIA
GPT-OSS-120B

NVIDIA NIM for GPU accelerated GPT-OSS-120B Model inference through OpenAI compatible APIs

  • LayerLabelCreated
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
    ["/bin/bash" "/opt/nim/start_server.sh"]
    02/26/2026 2:46 AM UTC
    sha256:90163a6e7449c46587f5f88306d4e6674b888b08af3be4fc4e82b63db91ceba0COPY
    --chmod=755 ./entrypoint.sh /opt/nim/start_server.sh
    02/26/2026 2:46 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    SERVER_START_SCRIPT_PATH=/opt/nim/start_server.sh
    02/26/2026 2:46 AM UTC
    sha256:d9a7b5028071bdf55bc1456f7964e7fca9d90e9cbe0fec528cf7fd99247bacc9COPY
    model_manifest.yaml /opt/nim/etc/default/model_manifest.yaml
    02/26/2026 2:46 AM UTC
    sha256:9740217564ce233a113d4e2b005cc80cb417c19294f389d0755161d2f407d47bRUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple mkdir -p $TIKTOKEN_ENCODINGS_BASE &&
      curl -L -o $TIKTOKEN_ENCODINGS_BASE/o200k_base.tiktoken "https://openaipublic.blob.core.windows.net/encodings/o200k_base.tiktoken" &&
      curl -L -o $TIKTOKEN_ENCODINGS_BASE/cl100k_base.tiktoken "https://openaipublic.blob.core.windows.net/encodings/cl100k_base.tiktoken" &&
      chmod 755 $TIKTOKEN_ENCODINGS_BASE &&
      chmod 644 $TIKTOKEN_ENCODINGS_BASE/*.tiktoken
    02/26/2026 2:46 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
    TIKTOKEN_ENCODINGS_BASE=/opt/nim/encodings
    02/26/2026 2:46 AM UTC
    sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4USER
    nvs:1000
    02/26/2026 2:46 AM UTC
    sha256:c48bc52e804b6a50ca5cf543825d620fcaf7ba0e55ddc31f192d36cc4f37f994RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple [ -d /etc/ld.so.conf.d ] ||
      mkdir -p /etc/ld.so.conf.d &&
      [ -f /etc/ld.so.conf.d/nvidia.conf ] ||
      touch /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/nvidia/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
      if command -v ldconfig >/dev/null 2>&1; then ldconfig; fi
    02/26/2026 2:46 AM UTC
    sha256:d293d940b03a1503ec17938634f76cf5ddfa90985dfbf078259602bab6cebad3RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple groupadd --gid 1000 --non-unique nvs &&
      useradd --create-home --shell /usr/sbin/nologin --uid 1000 --non-unique --gid 1000 nvs &&
      mkdir -p $NIM_CACHE_PATH &&
      chown -R 1000:1000 $NIM_DIR_PATH $NIM_CACHE_PATH
    02/26/2026 2:46 AM UTC
    sha256:345c628adc0ded8df524831f9dc0e6abc141b84b71e1234b6efc07e379543c18RUN
    TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple patch /usr/local/lib/python3.12/dist-packages/nimlib/profiles.py < /tmp/patches/nimlib/profiles.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/llm/profile_selection.py < /tmp/patches/nimlib/profile_selection.patch &&
      patch /usr/local/lib/python3.12/dist-packages/nimlib/download.py < /tmp/patches/nimlib/download.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/custom_error_models.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/start_server_banner.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/standard_files_banner_log.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/vllm/entrypoints/openai < /tmp/patches/vllm/protocol_validation.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/config_offline.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/inference_engine.patch &&
      patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/backends/vllm_backend.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/lora_bw.patch &&
      patch /usr/local/lib/python3.12/dist-packages/vllm/entrypoints/harmony_utils.py < /tmp/patches/vllm/harmony_utils_channel.patch &&
      patch -p1 -d /usr/local/lib/python3.12/dist-packages < /tmp/patches/vllm/tool_choice_none.patch &&
      rm -rf /tmp/patches
    02/26/2026 2:46 AM UTC
    ...