Text-to-Speech
Transformers
ONNX
teratts_onnx
feature-extraction
onnxruntime
russian
english
custom-code
custom_code
Instructions to use TeraSpace/TeraTTSv2 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use TeraSpace/TeraTTSv2 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-to-speech", model="TeraSpace/TeraTTSv2", trust_remote_code=True)# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("TeraSpace/TeraTTSv2", trust_remote_code=True, device_map="auto") - Notebooks
- Google Colab
- Kaggle
Add TeraTTS ONNX release artifacts
Browse files- .gitattributes +3 -0
- models/duration_predictor.onnx +3 -0
- models/sampler_distilled_cfg3_8step.onnx +3 -0
- models/sampler_teacher_8step.onnx +3 -0
- models/text_encoder.onnx +3 -0
- models/vocoder.onnx +3 -0
- ruaccent/dictionary/accents.json.gz +3 -0
- ruaccent/dictionary/omographs.json.gz +3 -0
- ruaccent/dictionary/yo_homographs.json.gz +0 -0
- ruaccent/dictionary/yo_words.json.gz +3 -0
- ruaccent/nn/nn_accent/big.onnx +3 -0
- ruaccent/nn/nn_accent/config.json +37 -0
- ruaccent/nn/nn_accent/model.onnx +3 -0
- ruaccent/nn/nn_accent/ort_config.json +30 -0
- ruaccent/nn/nn_accent/special_tokens_map.json +6 -0
- ruaccent/nn/nn_accent/tokenizer_config.json +10 -0
- ruaccent/nn/nn_accent/vocab.txt +45 -0
- ruaccent/nn/nn_omograph/turbo3.1/added_tokens.json +0 -0
- ruaccent/nn/nn_omograph/turbo3.1/config.json +28 -0
- ruaccent/nn/nn_omograph/turbo3.1/merges.txt +0 -0
- ruaccent/nn/nn_omograph/turbo3.1/model.onnx +3 -0
- ruaccent/nn/nn_omograph/turbo3.1/special_tokens_map.json +15 -0
- ruaccent/nn/nn_omograph/turbo3.1/tokenizer.json +0 -0
- ruaccent/nn/nn_omograph/turbo3.1/tokenizer_config.json +22 -0
- ruaccent/nn/nn_omograph/turbo3.1/vocab.json +0 -0
- ruaccent/nn/nn_stress_usage_predictor/config.json +36 -0
- ruaccent/nn/nn_stress_usage_predictor/model.onnx +3 -0
- ruaccent/nn/nn_stress_usage_predictor/special_tokens_map.json +7 -0
- ruaccent/nn/nn_stress_usage_predictor/tokenizer.json +0 -0
- ruaccent/nn/nn_stress_usage_predictor/tokenizer_config.json +15 -0
- ruaccent/nn/nn_stress_usage_predictor/vocab.txt +0 -0
- ruaccent/nn/nn_yo_homograph_resolver/config.json +32 -0
- ruaccent/nn/nn_yo_homograph_resolver/model.onnx +3 -0
- ruaccent/nn/nn_yo_homograph_resolver/special_tokens_map.json +7 -0
- ruaccent/nn/nn_yo_homograph_resolver/tokenizer.json +0 -0
- ruaccent/nn/nn_yo_homograph_resolver/tokenizer_config.json +15 -0
- ruaccent/nn/nn_yo_homograph_resolver/vocab.txt +0 -0
- styles/en_female/style_dp.npy +3 -0
- styles/en_female/style_ttl.npy +3 -0
- styles/en_male/style_dp.npy +3 -0
- styles/en_male/style_ttl.npy +3 -0
- styles/masha_ls/style_dp.npy +3 -0
- styles/masha_ls/style_ttl.npy +3 -0
- styles/mita/style_dp.npy +3 -0
- styles/mita/style_ttl.npy +3 -0
- styles/ru_female/style_dp.npy +3 -0
- styles/ru_female/style_ttl.npy +3 -0
- styles/ru_male/style_dp.npy +3 -0
- styles/ru_male/style_ttl.npy +3 -0
- unicode_indexer.json +0 -0
.gitattributes
CHANGED
|
@@ -1,2 +1,5 @@
|
|
| 1 |
*.onnx filter=lfs diff=lfs merge=lfs -text
|
| 2 |
*.npy filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
*.onnx filter=lfs diff=lfs merge=lfs -text
|
| 2 |
*.npy filter=lfs diff=lfs merge=lfs -text
|
| 3 |
+
ruaccent/dictionary/accents.json.gz filter=lfs diff=lfs merge=lfs -text
|
| 4 |
+
ruaccent/dictionary/omographs.json.gz filter=lfs diff=lfs merge=lfs -text
|
| 5 |
+
ruaccent/dictionary/yo_words.json.gz filter=lfs diff=lfs merge=lfs -text
|
models/duration_predictor.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:15248b4751493fe48543f01164cd9b74d103b4483c63367a01c344442ebf03d8
|
| 3 |
+
size 1572411
|
models/sampler_distilled_cfg3_8step.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e496d23538fb22fcb726034544bc409f19cd5cd97621d8712afe9e344e1ec4a3
|
| 3 |
+
size 256417627
|
models/sampler_teacher_8step.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:1390ff3449cf50f79a15543888022d13c5fa86398713bf42da56e74f023bbf82
|
| 3 |
+
size 256528334
|
models/text_encoder.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8966b3d2267d891f9329c1750481c4685b3e22b098a75c512d06d714a4e5ef05
|
| 3 |
+
size 27910297
|
models/vocoder.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d4e4cf9a9b9de8cca28f309c4cb7735327322b5a764ba61dfc3706c3c7942c07
|
| 3 |
+
size 101416199
|
ruaccent/dictionary/accents.json.gz
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:aa460ebba90de00fbbf3d41d121961f605b98667e45efb7920f127473b15515e
|
| 3 |
+
size 20954156
|
ruaccent/dictionary/omographs.json.gz
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:04a9e81c68d65f65ba493fe0110f99e79087548c2beeec3032e2b66e28706f36
|
| 3 |
+
size 219047
|
ruaccent/dictionary/yo_homographs.json.gz
ADDED
|
Binary file (5.75 kB). View file
|
|
|
ruaccent/dictionary/yo_words.json.gz
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:a19fa89a964a0691d9fe4ee384783e3934904891843d8f59a1c480d67947a82a
|
| 3 |
+
size 548914
|
ruaccent/nn/nn_accent/big.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:47e69d9ae19f2a82e21b1c70f6a4bbfb1abc5759e98b2e67d009c5e9d7af18c9
|
| 3 |
+
size 2285217
|
ruaccent/nn/nn_accent/config.json
ADDED
|
@@ -0,0 +1,37 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"_name_or_path": "onnx_out",
|
| 3 |
+
"architectures": [
|
| 4 |
+
"RoFormerForTokenClassification"
|
| 5 |
+
],
|
| 6 |
+
"attention_probs_dropout_prob": 0.2,
|
| 7 |
+
"embedding_size": 128,
|
| 8 |
+
"hidden_act": "gelu",
|
| 9 |
+
"hidden_dropout_prob": 0.2,
|
| 10 |
+
"hidden_size": 128,
|
| 11 |
+
"id2label": {
|
| 12 |
+
"0": "NO",
|
| 13 |
+
"1": "STRESS_PRIMARY",
|
| 14 |
+
"2": "STRESS_SECONDARY"
|
| 15 |
+
},
|
| 16 |
+
"initializer_range": 0.02,
|
| 17 |
+
"intermediate_size": 256,
|
| 18 |
+
"label2id": {
|
| 19 |
+
"NO": 0,
|
| 20 |
+
"STRESS_PRIMARY": 1,
|
| 21 |
+
"STRESS_SECONDARY": 2
|
| 22 |
+
},
|
| 23 |
+
"layer_norm_eps": 1e-12,
|
| 24 |
+
"max_length": 40,
|
| 25 |
+
"max_position_embeddings": 60,
|
| 26 |
+
"max_relative_positions": 60,
|
| 27 |
+
"model_type": "roformer",
|
| 28 |
+
"num_attention_heads": 8,
|
| 29 |
+
"num_hidden_layers": 4,
|
| 30 |
+
"pad_token_id": 0,
|
| 31 |
+
"relative_attention": true,
|
| 32 |
+
"rotary_value": false,
|
| 33 |
+
"transformers_version": "4.29.2",
|
| 34 |
+
"type_vocab_size": 2,
|
| 35 |
+
"use_cache": true,
|
| 36 |
+
"vocab_size": 45
|
| 37 |
+
}
|
ruaccent/nn/nn_accent/model.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4e393144e45626f6f1062a0784ef06f921b97321a8e7b87ac2a09a892286500a
|
| 3 |
+
size 803402
|
ruaccent/nn/nn_accent/ort_config.json
ADDED
|
@@ -0,0 +1,30 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"one_external_file": true,
|
| 3 |
+
"opset": null,
|
| 4 |
+
"optimization": {},
|
| 5 |
+
"optimum_version": "1.8.5",
|
| 6 |
+
"quantization": {
|
| 7 |
+
"activations_dtype": "QUInt8",
|
| 8 |
+
"activations_symmetric": false,
|
| 9 |
+
"format": "QOperator",
|
| 10 |
+
"is_static": false,
|
| 11 |
+
"mode": "IntegerOps",
|
| 12 |
+
"nodes_to_exclude": [],
|
| 13 |
+
"nodes_to_quantize": [],
|
| 14 |
+
"operators_to_quantize": [
|
| 15 |
+
"MatMul",
|
| 16 |
+
"Add"
|
| 17 |
+
],
|
| 18 |
+
"per_channel": false,
|
| 19 |
+
"qdq_add_pair_to_weight": false,
|
| 20 |
+
"qdq_dedicated_pair": false,
|
| 21 |
+
"qdq_op_type_per_channel_support_to_axis": {
|
| 22 |
+
"MatMul": 1
|
| 23 |
+
},
|
| 24 |
+
"reduce_range": false,
|
| 25 |
+
"weights_dtype": "QInt8",
|
| 26 |
+
"weights_symmetric": true
|
| 27 |
+
},
|
| 28 |
+
"transformers_version": "4.29.2",
|
| 29 |
+
"use_external_data_format": false
|
| 30 |
+
}
|
ruaccent/nn/nn_accent/special_tokens_map.json
ADDED
|
@@ -0,0 +1,6 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"bos_token": "[bos]",
|
| 3 |
+
"eos_token": "[eos]",
|
| 4 |
+
"pad_token": "[pad]",
|
| 5 |
+
"unk_token": "[unk]"
|
| 6 |
+
}
|
ruaccent/nn/nn_accent/tokenizer_config.json
ADDED
|
@@ -0,0 +1,10 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"bos_token": "[bos]",
|
| 3 |
+
"clean_up_tokenization_spaces": true,
|
| 4 |
+
"do_lower_case": true,
|
| 5 |
+
"eos_token": "[eos]",
|
| 6 |
+
"model_max_length": 1000000000000000019884624838656,
|
| 7 |
+
"pad_token": "[pad]",
|
| 8 |
+
"tokenizer_class": "CharTokenizer",
|
| 9 |
+
"unk_token": "[unk]"
|
| 10 |
+
}
|
ruaccent/nn/nn_accent/vocab.txt
ADDED
|
@@ -0,0 +1,45 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
[pad]
|
| 2 |
+
[unk]
|
| 3 |
+
[bos]
|
| 4 |
+
[eos]
|
| 5 |
+
'
|
| 6 |
+
-
|
| 7 |
+
.
|
| 8 |
+
?
|
| 9 |
+
`
|
| 10 |
+
c
|
| 11 |
+
e
|
| 12 |
+
́
|
| 13 |
+
а
|
| 14 |
+
б
|
| 15 |
+
в
|
| 16 |
+
г
|
| 17 |
+
д
|
| 18 |
+
е
|
| 19 |
+
ж
|
| 20 |
+
з
|
| 21 |
+
и
|
| 22 |
+
й
|
| 23 |
+
к
|
| 24 |
+
л
|
| 25 |
+
м
|
| 26 |
+
н
|
| 27 |
+
о
|
| 28 |
+
п
|
| 29 |
+
р
|
| 30 |
+
с
|
| 31 |
+
т
|
| 32 |
+
у
|
| 33 |
+
ф
|
| 34 |
+
х
|
| 35 |
+
ц
|
| 36 |
+
ч
|
| 37 |
+
ш
|
| 38 |
+
щ
|
| 39 |
+
ъ
|
| 40 |
+
ы
|
| 41 |
+
ь
|
| 42 |
+
э
|
| 43 |
+
ю
|
| 44 |
+
я
|
| 45 |
+
ё
|
ruaccent/nn/nn_omograph/turbo3.1/added_tokens.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_omograph/turbo3.1/config.json
ADDED
|
@@ -0,0 +1,28 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"_name_or_path": "turbo4_1/",
|
| 3 |
+
"architectures": [
|
| 4 |
+
"DebertaForSequenceClassification"
|
| 5 |
+
],
|
| 6 |
+
"attention_probs_dropout_prob": 0.1,
|
| 7 |
+
"hidden_act": "gelu",
|
| 8 |
+
"hidden_dropout_prob": 0.1,
|
| 9 |
+
"hidden_size": 768,
|
| 10 |
+
"initializer_range": 0.02,
|
| 11 |
+
"intermediate_size": 3072,
|
| 12 |
+
"layer_norm_eps": 1e-07,
|
| 13 |
+
"max_position_embeddings": 512,
|
| 14 |
+
"max_relative_positions": -1,
|
| 15 |
+
"model_type": "deberta",
|
| 16 |
+
"num_attention_heads": 12,
|
| 17 |
+
"num_hidden_layers": 6,
|
| 18 |
+
"pad_token_id": 0,
|
| 19 |
+
"pooler_dropout": 0,
|
| 20 |
+
"pooler_hidden_act": "gelu",
|
| 21 |
+
"pooler_hidden_size": 768,
|
| 22 |
+
"pos_att_type": null,
|
| 23 |
+
"position_biased_input": true,
|
| 24 |
+
"relative_attention": false,
|
| 25 |
+
"transformers_version": "4.29.1",
|
| 26 |
+
"type_vocab_size": 0,
|
| 27 |
+
"vocab_size": 60258
|
| 28 |
+
}
|
ruaccent/nn/nn_omograph/turbo3.1/merges.txt
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_omograph/turbo3.1/model.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:2cb6a174c4cdb45bd3132b4f7c8a3779fc4b6869863180ed7d0e421bcd453dbd
|
| 3 |
+
size 359306923
|
ruaccent/nn/nn_omograph/turbo3.1/special_tokens_map.json
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"bos_token": "<s>",
|
| 3 |
+
"cls_token": "<s>",
|
| 4 |
+
"eos_token": "</s>",
|
| 5 |
+
"mask_token": {
|
| 6 |
+
"content": "<mask>",
|
| 7 |
+
"lstrip": true,
|
| 8 |
+
"normalized": false,
|
| 9 |
+
"rstrip": false,
|
| 10 |
+
"single_word": false
|
| 11 |
+
},
|
| 12 |
+
"pad_token": "<pad>",
|
| 13 |
+
"sep_token": "</s>",
|
| 14 |
+
"unk_token": "<unk>"
|
| 15 |
+
}
|
ruaccent/nn/nn_omograph/turbo3.1/tokenizer.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_omograph/turbo3.1/tokenizer_config.json
ADDED
|
@@ -0,0 +1,22 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"add_prefix_space": false,
|
| 3 |
+
"bos_token": "<s>",
|
| 4 |
+
"clean_up_tokenization_spaces": true,
|
| 5 |
+
"cls_token": "<s>",
|
| 6 |
+
"eos_token": "</s>",
|
| 7 |
+
"errors": "replace",
|
| 8 |
+
"mask_token": {
|
| 9 |
+
"__type": "AddedToken",
|
| 10 |
+
"content": "<mask>",
|
| 11 |
+
"lstrip": true,
|
| 12 |
+
"normalized": false,
|
| 13 |
+
"rstrip": false,
|
| 14 |
+
"single_word": false
|
| 15 |
+
},
|
| 16 |
+
"model_max_length": 512,
|
| 17 |
+
"pad_token": "<pad>",
|
| 18 |
+
"sep_token": "</s>",
|
| 19 |
+
"tokenizer_class": "RobertaTokenizer",
|
| 20 |
+
"trim_offsets": true,
|
| 21 |
+
"unk_token": "<unk>"
|
| 22 |
+
}
|
ruaccent/nn/nn_omograph/turbo3.1/vocab.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_stress_usage_predictor/config.json
ADDED
|
@@ -0,0 +1,36 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"_name_or_path": "tiny/checkpoint-59441/",
|
| 3 |
+
"architectures": [
|
| 4 |
+
"BertForTokenClassification"
|
| 5 |
+
],
|
| 6 |
+
"attention_probs_dropout_prob": 0.1,
|
| 7 |
+
"classifier_dropout": null,
|
| 8 |
+
"emb_size": 312,
|
| 9 |
+
"gradient_checkpointing": false,
|
| 10 |
+
"hidden_act": "gelu",
|
| 11 |
+
"hidden_dropout_prob": 0.1,
|
| 12 |
+
"hidden_size": 312,
|
| 13 |
+
"id2label": {
|
| 14 |
+
"0": "NO_STRESS",
|
| 15 |
+
"1": "PUNCT",
|
| 16 |
+
"2": "STRESS"
|
| 17 |
+
},
|
| 18 |
+
"initializer_range": 0.02,
|
| 19 |
+
"intermediate_size": 600,
|
| 20 |
+
"label2id": {
|
| 21 |
+
"NO_STRESS": 0,
|
| 22 |
+
"PUNCT": 1,
|
| 23 |
+
"STRESS": 2
|
| 24 |
+
},
|
| 25 |
+
"layer_norm_eps": 1e-12,
|
| 26 |
+
"max_position_embeddings": 2048,
|
| 27 |
+
"model_type": "bert",
|
| 28 |
+
"num_attention_heads": 12,
|
| 29 |
+
"num_hidden_layers": 3,
|
| 30 |
+
"pad_token_id": 0,
|
| 31 |
+
"position_embedding_type": "absolute",
|
| 32 |
+
"transformers_version": "4.28.1",
|
| 33 |
+
"type_vocab_size": 2,
|
| 34 |
+
"use_cache": true,
|
| 35 |
+
"vocab_size": 83828
|
| 36 |
+
}
|
ruaccent/nn/nn_stress_usage_predictor/model.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3d547500637b4ddfec8880ed6d1405fd50ee9d3f0131ef8a2a69dcf961dbefeb
|
| 3 |
+
size 116473561
|
ruaccent/nn/nn_stress_usage_predictor/special_tokens_map.json
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cls_token": "[CLS]",
|
| 3 |
+
"mask_token": "[MASK]",
|
| 4 |
+
"pad_token": "[PAD]",
|
| 5 |
+
"sep_token": "[SEP]",
|
| 6 |
+
"unk_token": "[UNK]"
|
| 7 |
+
}
|
ruaccent/nn/nn_stress_usage_predictor/tokenizer.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_stress_usage_predictor/tokenizer_config.json
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"clean_up_tokenization_spaces": true,
|
| 3 |
+
"cls_token": "[CLS]",
|
| 4 |
+
"do_basic_tokenize": true,
|
| 5 |
+
"do_lower_case": false,
|
| 6 |
+
"mask_token": "[MASK]",
|
| 7 |
+
"model_max_length": 2048,
|
| 8 |
+
"never_split": null,
|
| 9 |
+
"pad_token": "[PAD]",
|
| 10 |
+
"sep_token": "[SEP]",
|
| 11 |
+
"strip_accents": null,
|
| 12 |
+
"tokenize_chinese_chars": true,
|
| 13 |
+
"tokenizer_class": "BertTokenizer",
|
| 14 |
+
"unk_token": "[UNK]"
|
| 15 |
+
}
|
ruaccent/nn/nn_stress_usage_predictor/vocab.txt
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_yo_homograph_resolver/config.json
ADDED
|
@@ -0,0 +1,32 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"_name_or_path": "5k/",
|
| 3 |
+
"activation": "gelu",
|
| 4 |
+
"architectures": [
|
| 5 |
+
"DistilBertForTokenClassification"
|
| 6 |
+
],
|
| 7 |
+
"attention_dropout": 0.1,
|
| 8 |
+
"dim": 264,
|
| 9 |
+
"dropout": 0.1,
|
| 10 |
+
"hidden_dim": 792,
|
| 11 |
+
"id2label": {
|
| 12 |
+
"0": "NO_YO",
|
| 13 |
+
"1": "PUNCT",
|
| 14 |
+
"2": "YO"
|
| 15 |
+
},
|
| 16 |
+
"initializer_range": 0.02,
|
| 17 |
+
"label2id": {
|
| 18 |
+
"NO_YO": 0,
|
| 19 |
+
"PUNCT": 1,
|
| 20 |
+
"YO": 2
|
| 21 |
+
},
|
| 22 |
+
"max_position_embeddings": 512,
|
| 23 |
+
"model_type": "distilbert",
|
| 24 |
+
"n_heads": 12,
|
| 25 |
+
"n_layers": 3,
|
| 26 |
+
"pad_token_id": 0,
|
| 27 |
+
"qa_dropout": 0.1,
|
| 28 |
+
"seq_classif_dropout": 0.2,
|
| 29 |
+
"sinusoidal_pos_embds": false,
|
| 30 |
+
"transformers_version": "4.29.2",
|
| 31 |
+
"vocab_size": 5031
|
| 32 |
+
}
|
ruaccent/nn/nn_yo_homograph_resolver/model.onnx
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:42cc85bf0c4b319dfe3d89fa17b162a92fd5e1c651a657cb3d5f44978d4e70ac
|
| 3 |
+
size 14332169
|
ruaccent/nn/nn_yo_homograph_resolver/special_tokens_map.json
ADDED
|
@@ -0,0 +1,7 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"cls_token": "[CLS]",
|
| 3 |
+
"mask_token": "[MASK]",
|
| 4 |
+
"pad_token": "[PAD]",
|
| 5 |
+
"sep_token": "[SEP]",
|
| 6 |
+
"unk_token": "[UNK]"
|
| 7 |
+
}
|
ruaccent/nn/nn_yo_homograph_resolver/tokenizer.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
ruaccent/nn/nn_yo_homograph_resolver/tokenizer_config.json
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"clean_up_tokenization_spaces": true,
|
| 3 |
+
"cls_token": "[CLS]",
|
| 4 |
+
"do_basic_tokenize": true,
|
| 5 |
+
"do_lower_case": false,
|
| 6 |
+
"mask_token": "[MASK]",
|
| 7 |
+
"model_max_length": 1000000000000000019884624838656,
|
| 8 |
+
"never_split": null,
|
| 9 |
+
"pad_token": "[PAD]",
|
| 10 |
+
"sep_token": "[SEP]",
|
| 11 |
+
"strip_accents": null,
|
| 12 |
+
"tokenize_chinese_chars": true,
|
| 13 |
+
"tokenizer_class": "DistilBertTokenizer",
|
| 14 |
+
"unk_token": "[UNK]"
|
| 15 |
+
}
|
ruaccent/nn/nn_yo_homograph_resolver/vocab.txt
ADDED
|
Binary file (48.6 kB). View file
|
|
|
styles/en_female/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e99de1badbe70e56da671d2c27dccbfc2caeeb0fd71e80f9532df1811b8fcf40
|
| 3 |
+
size 640
|
styles/en_female/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:75d859b839a1cdb8e3204032b34719b63b7746da552f45d867d2eb72dd632067
|
| 3 |
+
size 51328
|
styles/en_male/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:87e6b87cfe57922b868096b7b4cecb87003cc096b177dbd6034c400ae8e437e6
|
| 3 |
+
size 640
|
styles/en_male/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:47efa51c3059b0eb5fd2a32f9dad1f7580808a1c95ff4d8bbd6c1b71fbf7244c
|
| 3 |
+
size 51328
|
styles/masha_ls/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:48c10c8c3e6f9016e4ff625425450b99772a9246ffed6b062d236f23863b27d1
|
| 3 |
+
size 640
|
styles/masha_ls/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:f5c1d3f7644d1250355400950fca234ddf3867c3fd8fc24bc6e153f81a3bf317
|
| 3 |
+
size 51328
|
styles/mita/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:189e1eabfccf8f0f76a6b10d84ba0fdde18de2ecc2c2e16e3a790f961db95382
|
| 3 |
+
size 640
|
styles/mita/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:bafbfbe93efe2e4a87e2365282e13fbab7ab6faaccea61e8d8258488f57435f6
|
| 3 |
+
size 51328
|
styles/ru_female/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:477b15db0dc2c5b2ab7794ffc1a8c6c6ae2e0881cc6865fb0da74de63445de96
|
| 3 |
+
size 640
|
styles/ru_female/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7f698b258230d56cce4bc344ff75ac789161dc25393cc6c44b82b119b9b7e9c5
|
| 3 |
+
size 51328
|
styles/ru_male/style_dp.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3f7bb78f77d4e88027e363b6d97402f0e493c4fd51b1aeb109371c4bab68ffe6
|
| 3 |
+
size 640
|
styles/ru_male/style_ttl.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:fb75241f50286775de651047da65f9a074f465c5336e26ada43626d15fe82581
|
| 3 |
+
size 51328
|
unicode_indexer.json
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|