Buckets:
erikkaum/training-cache-static / tokenizer-experiment /gate1 /cache /subsets /stackoverflow_title_body /meta.json
| { | |
| "source": "stackoverflow_title_body", | |
| "n_rows": 200000, | |
| "total_query_tokens": 2556354, | |
| "total_doc_tokens": 52817115, | |
| "tokenizer": "bert-base-uncased", | |
| "tokenizer_sha256": "ce64fce797c24f68df90b40a3f74f579b336a493db14bd583fd520ea0d8c9a98", | |
| "tokens_dtype": "u32", | |
| "offsets_dtype": "u64", | |
| "add_special_tokens": false | |
| } |
Xet Storage Details
- Size:
- 335 Bytes
- Xet hash:
- ca3f77b6cdeec095273d4036101091ef33b788cba924d2ed9bd86e262d1b10fa
·
Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.