benjamin commited on
Commit
326b56d
·
verified ·
1 Parent(s): 823e58e

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +1 -0
README.md CHANGED
@@ -30,6 +30,7 @@ Gemma-2B-IT-Byte performs competitively although it has been trained only on 1.3
30
  from transformers import AutoTokenizer, AutoModelForCausalLM
31
 
32
  tokenizer = AutoTokenizer.from_pretrained("benjamin/Gemma2-2B-IT-Byte")
 
33
 
34
  device = "cuda"
35
  model = AutoModelForCausalLM.from_pretrained("benjamin/Gemma2-2B-IT-Byte", trust_remote_code=True)
 
30
  from transformers import AutoTokenizer, AutoModelForCausalLM
31
 
32
  tokenizer = AutoTokenizer.from_pretrained("benjamin/Gemma2-2B-IT-Byte")
33
+ print("Vocab Size:", len(tokenizer)) # 256 bytes + some special tokens
34
 
35
  device = "cuda"
36
  model = AutoModelForCausalLM.from_pretrained("benjamin/Gemma2-2B-IT-Byte", trust_remote_code=True)