Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

junaid008
/
hindko-tokenizer

Northern Hindko
Southern Hindko
tokenizers
tokenizer
sentencepiece
unigram
hindko
low-resource
urdu-script
perso-arabic
Model card Files Files and versions
xet
Community
hindko-tokenizer
6.36 MB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 10 commits
junaid008's picture
junaid008
Update README.md
5eaa6de verified 2 days ago
  • benchmarks
    Add benchmark images (benchmarks/) 3 days ago
  • eval
    Add evaluation tables and charts 3 days ago
  • examples
    Upload quickstart.py 3 days ago
  • .gitattributes
    2.21 kB
    Add benchmark images (benchmarks/) 3 days ago
  • LICENSE
    19.3 kB
    License: CC BY 4.0; add benchmark gallery to the model card; refresh SHA256SUMS 3 days ago
  • README.md
    48.4 kB
    Update README.md 2 days ago
  • SHA256SUMS
    2.85 kB
    License: CC BY 4.0; add benchmark gallery to the model card; refresh SHA256SUMS 3 days ago
  • gauge.json
    6.91 kB
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago
  • sp.model
    669 kB
    xet
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago
  • sp.vocab
    951 kB
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago
  • special_tokens_map.json
    1.61 kB
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago
  • tokenizer.json
    2.16 MB
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago
  • tokenizer_config.json
    14.6 kB
    Hindko tokenizer v1.0.0: SentencePiece Unigram 32k (tokenizer files) 3 days ago