# TODO: When using this dataset, set model.length = 256 to match D3PM setup train: text8 valid: text8 tokenizer_name_or_path: text8 cache_dir: ./cache wrap: True streaming: False insert_train_eos: True insert_valid_eos: True