Skip to main content
NVIDIA
Nemotron-3-Super-120B-A12B (Experimental)
Container
NVIDIA
Nemotron-3-Super-120B-A12B (Experimental)

Nemotron-3-Super-120B-A12B is a large language model (LLM) trained from scratch by NVIDIA, and designed as a unified model for both reasoning and non-reasoning tasks.

LayerLabelCreated
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENTRYPOINT
["/bin/bash" "/opt/nim/start_server.sh"]
03/13/2026 2:51 AM UTC
sha256:09828b4c20fb33d0913cb2aab323137434fb427f1cec75f6cdd748417f107239COPY
--chmod=755 ./entrypoint.sh /opt/nim/start_server.sh
03/13/2026 2:51 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4ENV
SERVER_START_SCRIPT_PATH=/opt/nim/start_server.sh
03/13/2026 2:51 AM UTC
sha256:32788cf53912466cd77f2a05fcb9816e5f5c71fe90c3f6126b52fbeac9e55345COPY
model_manifest.yaml /opt/nim/etc/default/model_manifest.yaml
03/13/2026 2:51 AM UTC
sha256:a3ed95caeb02ffe68cdd9fd84406680ae93d633cb16422d00e8a7c22955b46d4USER
nvs:1000
03/13/2026 2:51 AM UTC
sha256:885963db88d97c16b25c35c511f6dcecc01a2e788d6c356b72bc5e37d9f9447aRUN
TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple mkdir -p /usr/local/lib/python3.12/dist-packages/flashinfer/data/csrc/nv_internal/tensorrt_llm/cutlass_instantiations &&
  chown -R nvs:nvs /usr/local/lib/python3.12/dist-packages/flashinfer/data/csrc/nv_internal/tensorrt_llm &&
  chmod -R 755 /usr/local/lib/python3.12/dist-packages/flashinfer/data/csrc/nv_internal/tensorrt_llm
03/13/2026 2:51 AM UTC
sha256:52b1b79c9723f3f3862dfacd46a3cbabf5fefff691941c9e72caa9545345da2eRUN
TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple [ -d /etc/ld.so.conf.d ] ||
  mkdir -p /etc/ld.so.conf.d &&
  [ -f /etc/ld.so.conf.d/nvidia.conf ] ||
  touch /etc/ld.so.conf.d/nvidia.conf &&
  echo "/usr/local/nvidia/lib" >> /etc/ld.so.conf.d/nvidia.conf &&
  echo "/usr/local/nvidia/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
  echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf &&
  if command -v ldconfig >/dev/null 2>&1; then ldconfig; fi
03/13/2026 2:51 AM UTC
sha256:b61b87fa4ad343a8f7ccf3b50b32a519afb74b6080e5bf1af6ede9cad4e93263RUN
TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple groupadd --gid 1000 --non-unique nvs &&
  useradd --create-home --shell /usr/sbin/nologin --uid 1000 --non-unique --gid 1000 nvs &&
  chown 1000.1000 $NIM_DIR_PATH
03/13/2026 2:51 AM UTC
sha256:d6f5c1201459e6a7998f00e6956c77f6b600d478944bcb007b4b7decef678b47RUN
TELEMETRY_MODE=0 TELEMETRY_ENDPOINT=0 PIP_INDEX_URL=https://urm.nvidia.com/artifactory/api/pypi/nv-shared-pypi/simple patch /usr/local/lib/python3.12/dist-packages/nimlib/nvml.py < /tmp/patches/nimlib/nvml.patch &&
  patch /usr/local/lib/python3.12/dist-packages/nimlib/profiles.py < /tmp/patches/nimlib/profiles.patch &&
  patch /usr/local/lib/python3.12/dist-packages/nimlib/profile_report.py < /tmp/patches/nimlib/profile_report.patch &&
  patch /usr/local/lib/python3.12/dist-packages/nimlib/llm/profile_selection.py < /tmp/patches/nimlib/profile_selection.patch &&
  patch /usr/local/lib/python3.12/dist-packages/nimlib/download.py < /tmp/patches/nimlib/download.patch &&
  patch /usr/local/lib/python3.12/dist-packages/nimlib/model_serve.py < /tmp/patches/nimlib/model_serve_s3.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/custom_error_models.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/nimlib/start_server_banner.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_protocol.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_backend_types.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_backend_guidance.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_backend_lm_format_enforcer.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_backend_outlines.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_backend_xgrammar.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/whitespace_request.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/responses_prev_reasoning.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/protocol_validation.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/serving_responses.patch &&
  patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/backends/vllm_backend.patch &&
  patch -p0 -d /usr/local/lib/python3.12/dist-packages/nim_inference_sdk < /tmp/patches/nim_inference_sdk/api/top_k.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/lora/01_lora_model.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/lora/02_worker_manager.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/lora/03_interfaces.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/lora/04_nemotron_h.patch &&
  for p in /tmp/patches/vllm/super_v3_custom/*.patch; do patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < "$p"; done &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/mamba_cache_rs_fp16.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/modelopt_mixed_precision.patch &&
  patch -p1 -d /usr/local/lib/python3.12/dist-packages/ < /tmp/patches/vllm/fused_moe.patch &&
  rm -rf /tmp/patches
03/13/2026 2:51 AM UTC
sha256:1dabbfd8e60edfdbfffeca396e466ac76b5f9039a8b93ecf09ff515a26ee4735COPY
./patches /tmp/patches
03/13/2026 2:51 AM UTC
...

NVIDIA uses cookies to improve your experience on our web site. We and our third-party partners also use cookies and other tools to collect and record information you provide as well as information about your interactions with our websites for performance improvement, analytics, and to assist in marketing efforts. By clicking "Accept All", you consent to our use of cookies and other tools as described in our Cookie Policy. You can manage your cookie settings by clicking on "Manage Settings." By continuing to use this site or by clicking one of the buttons below, you agree to our Terms of Service (which contains important waivers). Please see our Privacy Policy for more information on our privacy practices.