NVIDIA
STT Es Quartznet15x5
Model
NVIDIA
STT Es Quartznet15x5

Speech To Text (STT) model based on QuartzNet for recognizing Spanish speech.

  • 1 Version
    1.0.0rc1Selected
    03/10/2021 2:34 AM UTC67.82 MB
    Accuracy
    KeyValue
    MCV DEV SET WER (%)12.97
    Model
    KeyValue
    ARCHITECTUREQuartznet
    INPUTS16000 KHZ MONO-CHANNEL AUDIO (WAV FILES)
    OUTPUTSTRANSCRIPTION TEXT