ZambiaLLM-mBERT

Language Label Description
english English
chichewa Chichewa
nyanja_cinyanja Nyanja / Cinyanja
bemba_cibemba Bemba / Cibemba
tonga_chitonga Tonga / Chitonga
lozi_cilozi Lozi / Silozi
luvale_cilubale Luvale
lunda_cilunda Lunda
kaonde_kikaonde Kaonde
tumbuka_chitumbuka Tumbuka
lambya_chilambya Lambya
mambwe_cimambwe_lungu Mambwe / Lungu
lenje_cilenje Lenje
lamba_cilamba Lamba
chokwe_cichokwe Chokwe
lala_bisa Lala / Bisa
luchazi_ciluchazi Luchazi
swahili_congo Congolese Swahili
shona_cishona Shona
lusaka_slang Lusaka urban slang
unknown Unknown / unsupported / noisy text

from transformers import AutoTokenizer, AutoModelForSequenceClassification
import torch

model_name = "YOUR_USERNAME/ZambiaLLM-mBERT"

tokenizer = AutoTokenizer.from_pretrained(model_name)
model = AutoModelForSequenceClassification.from_pretrained(model_name)

text = "iwe butah naleya ku town today"

inputs = tokenizer(
    text,
    return_tensors="pt",
    truncation=True,
    padding=True
)

with torch.no_grad():
    outputs = model(**inputs)

pred = outputs.logits.argmax(dim=-1).item()

print(pred)

confusion_matrix

language_performance

word_cloud

Downloads last month
12
Safetensors
Model size
0.3B params
Tensor type
F32
F16
U8
Inference Providers NEW
This model isn't deployed by any Inference Provider. 馃檵 Ask for provider support

Model tree for kelvinmbewe/ZambiaLLM_mmBERT

Quantized
(263)
this model

Evaluation results

  • Macro F1 on Custom Multilingual African Dataset
    self-reported
    0.880