Meta
Meta Llama3.2 3B Instruct ONNX INT4 RTX TensorRT Model Optimizer
Model
Meta
Meta Llama3.2 3B Instruct ONNX INT4 RTX TensorRT Model Optimizer

Meta Llama 3.2 3B Instruct INT4 ONNX model is the quantized version of the Meta Llama-3.2-3B-Instruct model, which is an auto-regressive language model that uses an optimized transformer architecture.

  • 1 Version
    1.0Selected
    11/18/2024 7:16 PM UTC2.86 GB