Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

nvidia
/
stt_en_fastconformer_transducer_xxlarge

Automatic Speech Recognition
NeMo
PyTorch
English
speech
audio
Transducer
FastConformer
Transformer
NeMo
hf-asr-leaderboard
Eval Results (legacy)
Model card Files Files and versions
xet
Community

Instructions to use nvidia/stt_en_fastconformer_transducer_xxlarge with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • NeMo

    How to use nvidia/stt_en_fastconformer_transducer_xxlarge with NeMo:

    import nemo.collections.asr as nemo_asr
    asr_model = nemo_asr.models.ASRModel.from_pretrained("nvidia/stt_en_fastconformer_transducer_xxlarge")
    
    transcriptions = asr_model.transcribe(["file.wav"])
  • Notebooks
  • Google Colab
  • Kaggle
stt_en_fastconformer_transducer_xxlarge
4.28 GB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 7 commits
nithinraok's picture
nithinraok
Update README.md
c2dc3b1 almost 3 years ago
  • .gitattributes
    1.56 kB
    Upload stt_en_fastconformer_transducer_xxlarge.nemo over 3 years ago
  • README.md
    9.54 kB
    Update README.md almost 3 years ago
  • stt_en_fastconformer_transducer_xxlarge.nemo
    4.28 GB
    xet
    update asr model ckpt to newer version about 3 years ago