luhya-asr-w2v-BERT / checkpoint-436 /trainer_state.json
Sam4rano's picture
Upload folder using huggingface_hub
53848f2 verified
Raw
History Blame Contribute Delete
9.08 kB
{
"best_global_step": 436,
"best_metric": 72.5967427427653,
"best_model_checkpoint": "/content/drive/MyDrive/luhya-asr-output/w2v-BERT-19072026-194426/checkpoint-436",
"epoch": 2.0,
"eval_steps": 500,
"global_step": 436,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.04605641911341393,
"grad_norm": 302.78094482421875,
"learning_rate": 4.896788990825688e-05,
"loss": 100.79736328125,
"step": 10
},
{
"epoch": 0.09211283822682786,
"grad_norm": 96.31173706054688,
"learning_rate": 4.782110091743119e-05,
"loss": 29.8587158203125,
"step": 20
},
{
"epoch": 0.1381692573402418,
"grad_norm": 147.86524963378906,
"learning_rate": 4.6674311926605504e-05,
"loss": 25.251905822753905,
"step": 30
},
{
"epoch": 0.18422567645365573,
"grad_norm": 120.08334350585938,
"learning_rate": 4.552752293577982e-05,
"loss": 24.0516357421875,
"step": 40
},
{
"epoch": 0.23028209556706966,
"grad_norm": 133.7987823486328,
"learning_rate": 4.438073394495413e-05,
"loss": 23.734429931640626,
"step": 50
},
{
"epoch": 0.2763385146804836,
"grad_norm": 28.81552505493164,
"learning_rate": 4.323394495412844e-05,
"loss": 22.96393737792969,
"step": 60
},
{
"epoch": 0.3223949337938975,
"grad_norm": 30.897197723388672,
"learning_rate": 4.208715596330276e-05,
"loss": 18.289149475097656,
"step": 70
},
{
"epoch": 0.36845135290731146,
"grad_norm": 36.43586730957031,
"learning_rate": 4.094036697247707e-05,
"loss": 10.091092681884765,
"step": 80
},
{
"epoch": 0.41450777202072536,
"grad_norm": 23.889171600341797,
"learning_rate": 3.9793577981651374e-05,
"loss": 8.081570434570313,
"step": 90
},
{
"epoch": 0.4605641911341393,
"grad_norm": 12.13913631439209,
"learning_rate": 3.864678899082569e-05,
"loss": 6.8117424011230465,
"step": 100
},
{
"epoch": 0.5066206102475532,
"grad_norm": 19.779722213745117,
"learning_rate": 3.7500000000000003e-05,
"loss": 6.111298751831055,
"step": 110
},
{
"epoch": 0.5526770293609672,
"grad_norm": 21.565914154052734,
"learning_rate": 3.6353211009174315e-05,
"loss": 6.654579925537109,
"step": 120
},
{
"epoch": 0.5987334484743811,
"grad_norm": 17.181720733642578,
"learning_rate": 3.520642201834863e-05,
"loss": 5.409315872192383,
"step": 130
},
{
"epoch": 0.644789867587795,
"grad_norm": 14.709773063659668,
"learning_rate": 3.405963302752294e-05,
"loss": 4.476285552978515,
"step": 140
},
{
"epoch": 0.690846286701209,
"grad_norm": 13.595601081848145,
"learning_rate": 3.291284403669725e-05,
"loss": 5.213714218139648,
"step": 150
},
{
"epoch": 0.7369027058146229,
"grad_norm": 21.012601852416992,
"learning_rate": 3.176605504587156e-05,
"loss": 5.487786483764649,
"step": 160
},
{
"epoch": 0.7829591249280369,
"grad_norm": 25.596094131469727,
"learning_rate": 3.061926605504587e-05,
"loss": 6.074187088012695,
"step": 170
},
{
"epoch": 0.8290155440414507,
"grad_norm": 20.449750900268555,
"learning_rate": 2.9472477064220185e-05,
"loss": 4.950091171264648,
"step": 180
},
{
"epoch": 0.8750719631548647,
"grad_norm": 29.11081314086914,
"learning_rate": 2.8325688073394496e-05,
"loss": 4.692559051513672,
"step": 190
},
{
"epoch": 0.9211283822682786,
"grad_norm": 21.46868896484375,
"learning_rate": 2.7178899082568808e-05,
"loss": 5.285316085815429,
"step": 200
},
{
"epoch": 0.9671848013816926,
"grad_norm": 8.233875274658203,
"learning_rate": 2.6032110091743123e-05,
"loss": 5.215562438964843,
"step": 210
},
{
"epoch": 1.0092112838226828,
"grad_norm": 14.265213966369629,
"learning_rate": 2.4885321100917434e-05,
"loss": 4.8710376739501955,
"step": 220
},
{
"epoch": 1.0552677029360966,
"grad_norm": 14.12139892578125,
"learning_rate": 2.3738532110091743e-05,
"loss": 4.005696487426758,
"step": 230
},
{
"epoch": 1.1013241220495107,
"grad_norm": 16.45650863647461,
"learning_rate": 2.2591743119266058e-05,
"loss": 4.499768829345703,
"step": 240
},
{
"epoch": 1.1473805411629245,
"grad_norm": 16.737659454345703,
"learning_rate": 2.1444954128440366e-05,
"loss": 4.547027969360352,
"step": 250
},
{
"epoch": 1.1934369602763386,
"grad_norm": 88.76078033447266,
"learning_rate": 2.029816513761468e-05,
"loss": 4.956865310668945,
"step": 260
},
{
"epoch": 1.2394933793897525,
"grad_norm": 16.75699806213379,
"learning_rate": 1.9151376146788992e-05,
"loss": 4.699456024169922,
"step": 270
},
{
"epoch": 1.2855497985031663,
"grad_norm": 14.480719566345215,
"learning_rate": 1.8004587155963304e-05,
"loss": 3.9641571044921875,
"step": 280
},
{
"epoch": 1.3316062176165804,
"grad_norm": 15.892351150512695,
"learning_rate": 1.6857798165137616e-05,
"loss": 3.8730567932128905,
"step": 290
},
{
"epoch": 1.3776626367299942,
"grad_norm": 16.750768661499023,
"learning_rate": 1.5711009174311927e-05,
"loss": 3.667850875854492,
"step": 300
},
{
"epoch": 1.4237190558434083,
"grad_norm": 14.369032859802246,
"learning_rate": 1.4564220183486239e-05,
"loss": 3.826851654052734,
"step": 310
},
{
"epoch": 1.4697754749568221,
"grad_norm": 10.422530174255371,
"learning_rate": 1.341743119266055e-05,
"loss": 3.818198394775391,
"step": 320
},
{
"epoch": 1.515831894070236,
"grad_norm": 12.948634147644043,
"learning_rate": 1.2270642201834864e-05,
"loss": 3.7835613250732423,
"step": 330
},
{
"epoch": 1.5618883131836498,
"grad_norm": 22.908647537231445,
"learning_rate": 1.1123853211009175e-05,
"loss": 4.017103958129883,
"step": 340
},
{
"epoch": 1.607944732297064,
"grad_norm": 61.0781135559082,
"learning_rate": 9.977064220183487e-06,
"loss": 4.477457427978516,
"step": 350
},
{
"epoch": 1.654001151410478,
"grad_norm": 31.72366714477539,
"learning_rate": 8.830275229357798e-06,
"loss": 3.53868408203125,
"step": 360
},
{
"epoch": 1.7000575705238918,
"grad_norm": 11.724701881408691,
"learning_rate": 7.68348623853211e-06,
"loss": 4.154517364501953,
"step": 370
},
{
"epoch": 1.7461139896373057,
"grad_norm": 9.129546165466309,
"learning_rate": 6.536697247706422e-06,
"loss": 3.2864849090576174,
"step": 380
},
{
"epoch": 1.7921704087507195,
"grad_norm": 18.702472686767578,
"learning_rate": 5.389908256880735e-06,
"loss": 3.455213928222656,
"step": 390
},
{
"epoch": 1.8382268278641336,
"grad_norm": 6.347196578979492,
"learning_rate": 4.2431192660550464e-06,
"loss": 3.5554222106933593,
"step": 400
},
{
"epoch": 1.8842832469775475,
"grad_norm": 10.64411735534668,
"learning_rate": 3.096330275229358e-06,
"loss": 3.60513916015625,
"step": 410
},
{
"epoch": 1.9303396660909615,
"grad_norm": 9.20349407196045,
"learning_rate": 1.94954128440367e-06,
"loss": 3.4330368041992188,
"step": 420
},
{
"epoch": 1.9763960852043754,
"grad_norm": 18.204687118530273,
"learning_rate": 8.027522935779817e-07,
"loss": 4.128760910034179,
"step": 430
},
{
"epoch": 2.0,
"eval_cer": 0.11358379197575177,
"eval_loss": 0.45508942008018494,
"eval_runtime": 56.7955,
"eval_samples_per_second": 7.043,
"eval_score": 72.5967427427653,
"eval_steps_per_second": 1.761,
"eval_wer": 0.4344813531689423,
"step": 436
}
],
"logging_steps": 10,
"max_steps": 436,
"num_input_tokens_seen": 0,
"num_train_epochs": 2,
"save_steps": 500,
"stateful_callbacks": {
"TrainerControl": {
"args": {
"should_epoch_stop": false,
"should_evaluate": false,
"should_log": false,
"should_save": true,
"should_training_stop": true
},
"attributes": {}
}
},
"total_flos": 9.444793548642445e+18,
"train_batch_size": 4,
"trial_name": null,
"trial_params": null
}