NVIDIA
NVIDIA
NeMo Framework Megatron Backend
Container
NVIDIA
NVIDIA
NeMo Framework Megatron Backend

NVIDIA NeMo™ framework Megatron backend supports pre-training, post-training, and reinforcement learning of LLMs and multi-modal generative AI models with state-of-the-art data processing, model training techniques, and flexible deployment options.

LayerLabelCreated
sha256:4f4fb700ef54461cfa02571ae0db9a0dc1e0cdb5577484a6d75e68dc38e8acc1WORKDIR
/opt
04/09/2024 2:35 AM UTC
sha256:4a50c9552cd8a71babb0c2e011a02fe72a8368b0f7faac0f55c01105d2850a0eRUN
git clone https://github.com/NVIDIA/NeMo.git &&
  cd NeMo &&
  git checkout chcui/conversion_precision_on_24.03 &&
  mkdir -p /opt/NeMo/scripts/checkpoint_converters &&
  cp scripts/checkpoint_converters/* /opt/NeMo/scripts/checkpoint_converters &&
  rm /tmp/NeMo -r
04/09/2024 2:35 AM UTC
sha256:4f4fb700ef54461cfa02571ae0db9a0dc1e0cdb5577484a6d75e68dc38e8acc1WORKDIR
/tmp
04/09/2024 2:35 AM UTC
sha256:1711e5690843d70130a5867bb5411f86877b431244bbbc1914c7dbb9e55f78e2COPY
llm_inference/changes/megatron_gpt_model.py /opt/NeMo/nemo/collections/nlp/models/language_modeling/megatron_gpt_model.py
04/09/2024 2:35 AM UTC
sha256:4d601922de02009248c58988e08b0fb4dda3ff39524e52bb786a8614f7492d37COPY
llm_inference/nemo-fw/scripts/export /opt/NeMo/scripts/export
04/09/2024 2:35 AM UTC
sha256:8d37603c452994ddc19b5050aa292e0a1392800453d527014c345560f2751111COPY
llm_inference/nemo-fw/scripts/deploy /opt/NeMo/scripts/deploy
04/09/2024 2:35 AM UTC
sha256:4c9edcc44754b0d0a75d391c38df38d33d32c5e13115e9721ba94ba0e6ddc01fCOPY
llm_inference/nemo-fw/nemo/export /opt/NeMo/nemo/export
04/09/2024 2:35 AM UTC
sha256:ae212bbbc180cd30039efe9cd2402abdd3fe48d316e477dbff2c224050c8a694COPY
llm_inference/nemo-fw/nemo/deploy /opt/NeMo/nemo/deploy
04/09/2024 2:35 AM UTC
sha256:c21e78ec52a52625e68ec7bee29dada3d697ece338fd59ad83ea3914c9fdfb7eRUN
ln -sv $(python3 -c 'import site; print(f"{site.getsitepackages()[0]}/tensorrt_llm/libs")') lib &&
  test -f lib/libnvinfer_plugin_tensorrt_llm.so &&
  ln -sv lib/libnvinfer_plugin_tensorrt_llm.so lib/libnvinfer_plugin_tensorrt_llm.so.9 &&
  echo "/app/tensorrt_llm/lib" > /etc/ld.so.conf.d/tensorrt_llm.conf &&
  ldconfig
03/18/2024 2:59 PM UTC
sha256:ae1dd4276f3e78f9062a56060bb180a527e98b3598c88216ba8d53d17242892dRUN
pip install tensorrt_llm*.whl --extra-index-url https://pypi.nvidia.com &&
  rm tensorrt_llm*.whl
03/18/2024 2:59 PM UTC
...