umarigan/tinystories_tr
Viewer • Updated • 1.9M • 144 • 5
How to use abakirci/admbkrc-turkish-tokenizer with Transformers:
# Load model directly
from transformers import AutoModel
model = AutoModel.from_pretrained("abakirci/admbkrc-turkish-tokenizer", device_map="auto")This is a Byte-Pair Encoding (BPE) tokenizer trained specifically for Turkish language. It's designed to be used in Turkish language model pretraining and NLP tasks.
Key Features:
from transformers import AutoTokenizer
tokenizer = AutoTokenizer.from_pretrained("abakirci/admbkrc-turkish-tokenizer")
text = "Bu bir Türkçe örnek cümledir."
encoded = tokenizer(text, return_tensors="pt")