Instructions to use tobiges/behavior_fast with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use tobiges/behavior_fast with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("tobiges/behavior_fast", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Upload processor
Browse files- processing_action_tokenizer.py +9 -9
- processor_config.json +1 -1
- tokenizer.json +0 -0
processing_action_tokenizer.py
CHANGED
|
@@ -171,15 +171,15 @@ class UniversalActionProcessor(ProcessorMixin):
|
|
| 171 |
|
| 172 |
# Train BPE tokenizer
|
| 173 |
tokenizer = Tokenizer(BPE())
|
| 174 |
-
tokenizer.pre_tokenizer = pre_tokenizers.ByteLevel(
|
| 175 |
-
|
| 176 |
-
)
|
| 177 |
-
tokenizer.decoder = decoders.ByteLevel(
|
| 178 |
-
|
| 179 |
-
)
|
| 180 |
-
tokenizer.post_processor = processors.ByteLevel(
|
| 181 |
-
|
| 182 |
-
)
|
| 183 |
|
| 184 |
# Set up the entire range of possible tokens as the initial alphabet
|
| 185 |
alphabet = [chr(i) for i in range(256)]
|
|
|
|
| 171 |
|
| 172 |
# Train BPE tokenizer
|
| 173 |
tokenizer = Tokenizer(BPE())
|
| 174 |
+
# tokenizer.pre_tokenizer = pre_tokenizers.ByteLevel(
|
| 175 |
+
# add_prefix_space=False, use_regex=False, trim_offsets=False
|
| 176 |
+
# )
|
| 177 |
+
# tokenizer.decoder = decoders.ByteLevel(
|
| 178 |
+
# add_prefix_space=False, trim_offsets=False, use_regex=False
|
| 179 |
+
# )
|
| 180 |
+
# tokenizer.post_processor = processors.ByteLevel(
|
| 181 |
+
# add_prefix_space=False, trim_offsets=False, use_regex=False
|
| 182 |
+
# )
|
| 183 |
|
| 184 |
# Set up the entire range of possible tokens as the initial alphabet
|
| 185 |
alphabet = [chr(i) for i in range(256)]
|
processor_config.json
CHANGED
|
@@ -6,6 +6,6 @@
|
|
| 6 |
"min_token": -128,
|
| 7 |
"processor_class": "UniversalActionProcessor",
|
| 8 |
"scale": 10.0,
|
| 9 |
-
"time_horizon":
|
| 10 |
"vocab_size": 1024
|
| 11 |
}
|
|
|
|
| 6 |
"min_token": -128,
|
| 7 |
"processor_class": "UniversalActionProcessor",
|
| 8 |
"scale": 10.0,
|
| 9 |
+
"time_horizon": 50,
|
| 10 |
"vocab_size": 1024
|
| 11 |
}
|
tokenizer.json
CHANGED
|
The diff for this file is too large to render.
See raw diff
|
|
|