Delete tokenizer

Files changed (5) hide show

tokenizer/source.spm DELETED Viewed

Binary file (797 kB)

tokenizer/special_tokens_map.json DELETED Viewed

@@ -1,5 +0,0 @@
-{
-  "eos_token": "</s>",
-  "pad_token": "<pad>",
-  "unk_token": "<unk>"
-}

tokenizer/target.spm DELETED Viewed

Binary file (823 kB)

tokenizer/tokenizer_config.json DELETED Viewed

@@ -1,38 +0,0 @@
-{
-  "added_tokens_decoder": {
-    "42432": {
-      "content": "</s>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    },
-    "51366": {
-      "content": "<unk>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    },
-    "57702": {
-      "content": "<pad>",
-      "lstrip": false,
-      "normalized": false,
-      "rstrip": false,
-      "single_word": false,
-      "special": true
-    }
-  },
-  "clean_up_tokenization_spaces": true,
-  "eos_token": "</s>",
-  "model_max_length": 512,
-  "pad_token": "<pad>",
-  "separate_vocabs": false,
-  "source_lang": "en",
-  "sp_model_kwargs": {},
-  "target_lang": "ces+slk",
-  "tokenizer_class": "MarianTokenizer",
-  "unk_token": "<unk>"
-}

tokenizer/vocab.json DELETED Viewed

The diff for this file is too large to render. See raw diff