rcspam commited on
Commit
555e523
·
verified ·
1 Parent(s): 4c094dc

Upload folder using huggingface_hub

Browse files
.gitattributes CHANGED
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ encoder-model.onnx.data filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,67 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: cc-by-4.0
3
+ language:
4
+ - en
5
+ - es
6
+ - fr
7
+ - de
8
+ - bg
9
+ - hr
10
+ - cs
11
+ - da
12
+ - nl
13
+ - et
14
+ - fi
15
+ - el
16
+ - hu
17
+ - it
18
+ - lv
19
+ - lt
20
+ - mt
21
+ - pl
22
+ - pt
23
+ - ro
24
+ - sk
25
+ - sl
26
+ - sv
27
+ - ru
28
+ - uk
29
+ base_model:
30
+ - nvidia/parakeet-tdt-0.6b-v3
31
+ pipeline_tag: automatic-speech-recognition
32
+ tags:
33
+ - automatic-speech-recognition
34
+ - asr
35
+ - onnx
36
+ - onnx-asr
37
+ ---
38
+
39
+ NVIDIA Parakeet TDT 0.6B V3 (Multilingual) [model](https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3) converted to ONNX format for [onnx-asr](https://github.com/istupakov/onnx-asr).
40
+
41
+ Install onnx-asr
42
+ ```shell
43
+ pip install onnx-asr[cpu,hub]
44
+ ```
45
+
46
+ Load Parakeet TDT model and recognize wav file
47
+ ```py
48
+ import onnx_asr
49
+ model = onnx_asr.load_model("nemo-parakeet-tdt-0.6b-v3")
50
+ print(model.recognize("test.wav"))
51
+ ```
52
+
53
+ Code for models export
54
+ ```py
55
+ import nemo.collections.asr as nemo_asr
56
+ from pathlib import Path
57
+
58
+ model = nemo_asr.models.ASRModel.from_pretrained("nvidia/parakeet-tdt-0.6b-v3")
59
+
60
+ onnx_dir = Path("nemo-onnx")
61
+ onnx_dir.mkdir(exist_ok=True)
62
+ model.export(str(Path(onnx_dir, "model.onnx")))
63
+
64
+ with Path(onnx_dir, "vocab.txt").open("wt") as f:
65
+ for i, token in enumerate([*model.tokenizer.vocab, "<blk>"]):
66
+ f.write(f"{token} {i}\n")
67
+ ```
config.json ADDED
@@ -0,0 +1,5 @@
 
 
 
 
 
 
1
+ {
2
+ "model_type": "nemo-conformer-tdt",
3
+ "features_size": 128,
4
+ "subsampling_factor": 8
5
+ }
decoder_joint-model.int8.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:eea7483ee3d1a30375daedc8ed83e3960c91b098812127a0d99d1c8977667a70
3
+ size 18202004
decoder_joint-model.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e978ddf6688527182c10fde2eb4b83068421648985ef23f7a86be732be8706c1
3
+ size 72520893
encoder-model.int8.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6139d2fa7e1b086097b277c7149725edbab89cc7c7ae64b23c741be4055aff09
3
+ size 652183999
encoder-model.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:98a74b21b4cc0017c1e7030319a4a96f4a9506e50f0708f3a516d02a77c96bb1
3
+ size 41770866
encoder-model.onnx.data ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9a22d372c51455c34f13405da2520baefb7125bd16981397561423ed32d24f36
3
+ size 2435420160
nemo128.onnx ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a9fde1486ebfcc08f328d75ad4610c67835fea58c73ba57e3209a6f6cf019e9f
3
+ size 139764
vocab.txt ADDED
The diff for this file is too large to render. See raw diff