Automatic Speech Recognition
NeMo
PyTorch
speaker-diarization
speaker-recognition
speech
audio
Transformer
FastConformer
Conformer
NEST
NeMo
Eval Results (legacy)
Instructions to use nvidia/diar_streaming_sortformer_4spk-v2 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- NeMo
How to use nvidia/diar_streaming_sortformer_4spk-v2 with NeMo:
import nemo.collections.asr as nemo_asr asr_model = nemo_asr.models.ASRModel.from_pretrained("nvidia/diar_streaming_sortformer_4spk-v2") transcriptions = asr_model.transcribe(["file.wav"]) - Notebooks
- Google Colab
- Kaggle
Upload 2 files
Browse files- .gitattributes +2 -0
- figures/aosc_3spk_example.gif +3 -0
- figures/aosc_4spk_example.gif +3 -0
.gitattributes
CHANGED
|
@@ -44,3 +44,5 @@ figures/sortformer_intro.png filter=lfs diff=lfs merge=lfs -text
|
|
| 44 |
figures/sortformer-v1-model.png filter=lfs diff=lfs merge=lfs -text
|
| 45 |
figures/streaming_sortformer_ani.gif filter=lfs diff=lfs merge=lfs -text
|
| 46 |
figures/streaming_steps.png filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
|
|
|
| 44 |
figures/sortformer-v1-model.png filter=lfs diff=lfs merge=lfs -text
|
| 45 |
figures/streaming_sortformer_ani.gif filter=lfs diff=lfs merge=lfs -text
|
| 46 |
figures/streaming_steps.png filter=lfs diff=lfs merge=lfs -text
|
| 47 |
+
figures/aosc_3spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
| 48 |
+
figures/aosc_4spk_example.gif filter=lfs diff=lfs merge=lfs -text
|
figures/aosc_3spk_example.gif
ADDED
|
Git LFS Details
|
figures/aosc_4spk_example.gif
ADDED
|
Git LFS Details
|