Transformers
tobiges commited on
Commit
72647e6
·
verified ·
1 Parent(s): 76017f9

Upload processor

Browse files
processing_action_tokenizer.py CHANGED
@@ -171,15 +171,15 @@ class UniversalActionProcessor(ProcessorMixin):
171
 
172
  # Train BPE tokenizer
173
  tokenizer = Tokenizer(BPE())
174
- tokenizer.pre_tokenizer = pre_tokenizers.ByteLevel(
175
- add_prefix_space=False, use_regex=False, trim_offsets=False
176
- )
177
- tokenizer.decoder = decoders.ByteLevel(
178
- add_prefix_space=False, trim_offsets=False, use_regex=False
179
- )
180
- tokenizer.post_processor = processors.ByteLevel(
181
- add_prefix_space=False, trim_offsets=False, use_regex=False
182
- )
183
 
184
  # Set up the entire range of possible tokens as the initial alphabet
185
  alphabet = [chr(i) for i in range(256)]
 
171
 
172
  # Train BPE tokenizer
173
  tokenizer = Tokenizer(BPE())
174
+ # tokenizer.pre_tokenizer = pre_tokenizers.ByteLevel(
175
+ # add_prefix_space=False, use_regex=False, trim_offsets=False
176
+ # )
177
+ # tokenizer.decoder = decoders.ByteLevel(
178
+ # add_prefix_space=False, trim_offsets=False, use_regex=False
179
+ # )
180
+ # tokenizer.post_processor = processors.ByteLevel(
181
+ # add_prefix_space=False, trim_offsets=False, use_regex=False
182
+ # )
183
 
184
  # Set up the entire range of possible tokens as the initial alphabet
185
  alphabet = [chr(i) for i in range(256)]
processor_config.json CHANGED
@@ -6,6 +6,6 @@
6
  "min_token": -128,
7
  "processor_class": "UniversalActionProcessor",
8
  "scale": 10.0,
9
- "time_horizon": null,
10
  "vocab_size": 1024
11
  }
 
6
  "min_token": -128,
7
  "processor_class": "UniversalActionProcessor",
8
  "scale": 10.0,
9
+ "time_horizon": 50,
10
  "vocab_size": 1024
11
  }
tokenizer.json CHANGED
The diff for this file is too large to render. See raw diff