Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
GursimranSinghBasra
/
akshara-tokenizer
like
0
6 languages
sentencepiece
tokenizer
indic-nlp
akshara
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
akshara-tokenizer
Ctrl+K
Ctrl+K
1 contributor
History:
5 commits
GursimranSinghBasra
Card: correct vocabulary share to 92.25 percent, add arm N result
3fcfcc3
verified
3 days ago
.gitattributes
Safe
1.52 kB
initial commit
18 days ago
CITATION.cff
320 Bytes
Add v1.2 model and map; update model card and CITATION to 1.2.0
15 days ago
LICENSE
10.9 kB
Add AksharaTokenizer v1.1 model, vocab, model card, license, citation
18 days ago
NOTICE
271 Bytes
Add AksharaTokenizer v1.1 model, vocab, model card, license, citation
18 days ago
README.md
11.4 kB
Card: correct vocabulary share to 92.25 percent, add arm N result
3 days ago
akshara_tokenizer_v1_1.model
563 kB
xet
Add AksharaTokenizer v1.1 model, vocab, model card, license, citation
18 days ago
akshara_tokenizer_v1_1.vocab
334 kB
Add AksharaTokenizer v1.1 model, vocab, model card, license, citation
18 days ago
akshara_tokenizer_v1_2.map.json
351 kB
Add v1.2 model and map; update model card and CITATION to 1.2.0
15 days ago
akshara_tokenizer_v1_2.model
1.22 MB
xet
Add v1.2 model and map; update model card and CITATION to 1.2.0
15 days ago