Automatic Speech Recognition
NeMo
PyTorch
speaker-diarization
speaker-recognition
speech
audio
Transformer
FastConformer
Conformer
NEST
NeMo
Eval Results (legacy)
Instructions to use nvidia/diar_streaming_sortformer_4spk-v2.1 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- NeMo
How to use nvidia/diar_streaming_sortformer_4spk-v2.1 with NeMo:
import nemo.collections.asr as nemo_asr asr_model = nemo_asr.models.ASRModel.from_pretrained("nvidia/diar_streaming_sortformer_4spk-v2.1") transcriptions = asr_model.transcribe(["file.wav"]) - Notebooks
- Google Colab
- Kaggle
Upload diar_streaming_sortformer_4spk-v2.1.nemo
Browse files- .gitattributes +1 -0
.gitattributes
CHANGED
|
@@ -38,3 +38,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 38 |
*.jpeg filter=lfs diff=lfs merge=lfs -text
|
| 39 |
figures/aosc_3spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
| 40 |
figures/aosc_4spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
| 38 |
*.jpeg filter=lfs diff=lfs merge=lfs -text
|
| 39 |
figures/aosc_3spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
| 40 |
figures/aosc_4spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
| 41 |
+
diar_streaming_sortformer_4spk-v2.1.nemo filter=lfs diff=lfs merge=lfs -text
|