Canarie
/

Soaring-8b

Llama3-8b-FlyingManual-Tutor

Model card Files Files and versions Community

minnmamin commited on Aug 3

Commit

fd081ff

•

1 Parent(s): 3474baf

Upload tokenizer

Files changed (2) hide show

special_tokens_map.json +2 -2
tokenizer_config.json +3 -3

special_tokens_map.json CHANGED Viewed

@@ -7,11 +7,11 @@
     "single_word": false
   },
   "eos_token": {
-    "content": "<|end_of_text|>",
     "lstrip": false,
     "normalized": false,
     "rstrip": false,
     "single_word": false
   },
-  "pad_token": "<|end_of_text|>"
 }

     "single_word": false
   },
   "eos_token": {
+    "content": "<|eot_id|>",
     "lstrip": false,
     "normalized": false,
     "rstrip": false,
     "single_word": false
   },
+  "pad_token": "<|eot_id|>"
 }

tokenizer_config.json CHANGED Viewed

@@ -2050,15 +2050,15 @@
     }
   },
   "bos_token": "<|begin_of_text|>",
-  "chat_template": "{% if messages[0]['role'] == 'system' %}{% set system_message = messages[0]['content'] %}{% endif %}{% if system_message is defined %}{{ system_message + '\n' }}{% endif %}{% for message in messages %}{% set content = message['content'] %}{% if message['role'] == 'user' %}{{ 'Human: ' + content + '\nAssistant:' }}{% elif message['role'] == 'assistant' %}{{ content + '<|end_of_text|>' + '\n' }}{% endif %}{% endfor %}",
   "clean_up_tokenization_spaces": true,
-  "eos_token": "<|end_of_text|>",
   "model_input_names": [
     "input_ids",
     "attention_mask"
   ],
   "model_max_length": 131072,
-  "pad_token": "<|end_of_text|>",
   "padding_side": "left",
   "split_special_tokens": false,
   "tokenizer_class": "PreTrainedTokenizerFast"

     }
   },
   "bos_token": "<|begin_of_text|>",
+  "chat_template": "{% if messages[0]['role'] == 'system' %}{% set system_message = messages[0]['content'] %}{% endif %}{% if system_message is defined %}{{ system_message + '\n' }}{% endif %}{% for message in messages %}{% set content = message['content'] %}{% if message['role'] == 'user' %}{{ 'Human: ' + content + '\nAssistant:' }}{% elif message['role'] == 'assistant' %}{{ content + '<|eot_id|>' + '\n' }}{% endif %}{% endfor %}",
   "clean_up_tokenization_spaces": true,
+  "eos_token": "<|eot_id|>",
   "model_input_names": [
     "input_ids",
     "attention_mask"
   ],
   "model_max_length": 131072,
+  "pad_token": "<|eot_id|>",
   "padding_side": "left",
   "split_special_tokens": false,
   "tokenizer_class": "PreTrainedTokenizerFast"