Buckets:
erikkaum/training-cache-static / tokenizer-experiment /gate1 /cache /subsets /yahoo_answer /meta.json
| { | |
| "source": "yahoo_answer", | |
| "n_rows": 10000, | |
| "total_query_tokens": 646284, | |
| "total_doc_tokens": 1097669, | |
| "tokenizer": "bert-base-uncased", | |
| "tokenizer_sha256": "ce64fce797c24f68df90b40a3f74f579b336a493db14bd583fd520ea0d8c9a98", | |
| "tokens_dtype": "u32", | |
| "offsets_dtype": "u64", | |
| "add_special_tokens": false | |
| } |
Xet Storage Details
- Size:
- 320 Bytes
- Xet hash:
- 21c4ac64b2af402c510a29af5cfb7585e1a33e300973d1586791f21522e30888
·
Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.