{ "best_global_step": 436, "best_metric": 72.5967427427653, "best_model_checkpoint": "/content/drive/MyDrive/luhya-asr-output/w2v-BERT-19072026-194426/checkpoint-436", "epoch": 2.0, "eval_steps": 500, "global_step": 436, "is_hyper_param_search": false, "is_local_process_zero": true, "is_world_process_zero": true, "log_history": [ { "epoch": 0.04605641911341393, "grad_norm": 302.78094482421875, "learning_rate": 4.896788990825688e-05, "loss": 100.79736328125, "step": 10 }, { "epoch": 0.09211283822682786, "grad_norm": 96.31173706054688, "learning_rate": 4.782110091743119e-05, "loss": 29.8587158203125, "step": 20 }, { "epoch": 0.1381692573402418, "grad_norm": 147.86524963378906, "learning_rate": 4.6674311926605504e-05, "loss": 25.251905822753905, "step": 30 }, { "epoch": 0.18422567645365573, "grad_norm": 120.08334350585938, "learning_rate": 4.552752293577982e-05, "loss": 24.0516357421875, "step": 40 }, { "epoch": 0.23028209556706966, "grad_norm": 133.7987823486328, "learning_rate": 4.438073394495413e-05, "loss": 23.734429931640626, "step": 50 }, { "epoch": 0.2763385146804836, "grad_norm": 28.81552505493164, "learning_rate": 4.323394495412844e-05, "loss": 22.96393737792969, "step": 60 }, { "epoch": 0.3223949337938975, "grad_norm": 30.897197723388672, "learning_rate": 4.208715596330276e-05, "loss": 18.289149475097656, "step": 70 }, { "epoch": 0.36845135290731146, "grad_norm": 36.43586730957031, "learning_rate": 4.094036697247707e-05, "loss": 10.091092681884765, "step": 80 }, { "epoch": 0.41450777202072536, "grad_norm": 23.889171600341797, "learning_rate": 3.9793577981651374e-05, "loss": 8.081570434570313, "step": 90 }, { "epoch": 0.4605641911341393, "grad_norm": 12.13913631439209, "learning_rate": 3.864678899082569e-05, "loss": 6.8117424011230465, "step": 100 }, { "epoch": 0.5066206102475532, "grad_norm": 19.779722213745117, "learning_rate": 3.7500000000000003e-05, "loss": 6.111298751831055, "step": 110 }, { "epoch": 0.5526770293609672, "grad_norm": 21.565914154052734, "learning_rate": 3.6353211009174315e-05, "loss": 6.654579925537109, "step": 120 }, { "epoch": 0.5987334484743811, "grad_norm": 17.181720733642578, "learning_rate": 3.520642201834863e-05, "loss": 5.409315872192383, "step": 130 }, { "epoch": 0.644789867587795, "grad_norm": 14.709773063659668, "learning_rate": 3.405963302752294e-05, "loss": 4.476285552978515, "step": 140 }, { "epoch": 0.690846286701209, "grad_norm": 13.595601081848145, "learning_rate": 3.291284403669725e-05, "loss": 5.213714218139648, "step": 150 }, { "epoch": 0.7369027058146229, "grad_norm": 21.012601852416992, "learning_rate": 3.176605504587156e-05, "loss": 5.487786483764649, "step": 160 }, { "epoch": 0.7829591249280369, "grad_norm": 25.596094131469727, "learning_rate": 3.061926605504587e-05, "loss": 6.074187088012695, "step": 170 }, { "epoch": 0.8290155440414507, "grad_norm": 20.449750900268555, "learning_rate": 2.9472477064220185e-05, "loss": 4.950091171264648, "step": 180 }, { "epoch": 0.8750719631548647, "grad_norm": 29.11081314086914, "learning_rate": 2.8325688073394496e-05, "loss": 4.692559051513672, "step": 190 }, { "epoch": 0.9211283822682786, "grad_norm": 21.46868896484375, "learning_rate": 2.7178899082568808e-05, "loss": 5.285316085815429, "step": 200 }, { "epoch": 0.9671848013816926, "grad_norm": 8.233875274658203, "learning_rate": 2.6032110091743123e-05, "loss": 5.215562438964843, "step": 210 }, { "epoch": 1.0092112838226828, "grad_norm": 14.265213966369629, "learning_rate": 2.4885321100917434e-05, "loss": 4.8710376739501955, "step": 220 }, { "epoch": 1.0552677029360966, "grad_norm": 14.12139892578125, "learning_rate": 2.3738532110091743e-05, "loss": 4.005696487426758, "step": 230 }, { "epoch": 1.1013241220495107, "grad_norm": 16.45650863647461, "learning_rate": 2.2591743119266058e-05, "loss": 4.499768829345703, "step": 240 }, { "epoch": 1.1473805411629245, "grad_norm": 16.737659454345703, "learning_rate": 2.1444954128440366e-05, "loss": 4.547027969360352, "step": 250 }, { "epoch": 1.1934369602763386, "grad_norm": 88.76078033447266, "learning_rate": 2.029816513761468e-05, "loss": 4.956865310668945, "step": 260 }, { "epoch": 1.2394933793897525, "grad_norm": 16.75699806213379, "learning_rate": 1.9151376146788992e-05, "loss": 4.699456024169922, "step": 270 }, { "epoch": 1.2855497985031663, "grad_norm": 14.480719566345215, "learning_rate": 1.8004587155963304e-05, "loss": 3.9641571044921875, "step": 280 }, { "epoch": 1.3316062176165804, "grad_norm": 15.892351150512695, "learning_rate": 1.6857798165137616e-05, "loss": 3.8730567932128905, "step": 290 }, { "epoch": 1.3776626367299942, "grad_norm": 16.750768661499023, "learning_rate": 1.5711009174311927e-05, "loss": 3.667850875854492, "step": 300 }, { "epoch": 1.4237190558434083, "grad_norm": 14.369032859802246, "learning_rate": 1.4564220183486239e-05, "loss": 3.826851654052734, "step": 310 }, { "epoch": 1.4697754749568221, "grad_norm": 10.422530174255371, "learning_rate": 1.341743119266055e-05, "loss": 3.818198394775391, "step": 320 }, { "epoch": 1.515831894070236, "grad_norm": 12.948634147644043, "learning_rate": 1.2270642201834864e-05, "loss": 3.7835613250732423, "step": 330 }, { "epoch": 1.5618883131836498, "grad_norm": 22.908647537231445, "learning_rate": 1.1123853211009175e-05, "loss": 4.017103958129883, "step": 340 }, { "epoch": 1.607944732297064, "grad_norm": 61.0781135559082, "learning_rate": 9.977064220183487e-06, "loss": 4.477457427978516, "step": 350 }, { "epoch": 1.654001151410478, "grad_norm": 31.72366714477539, "learning_rate": 8.830275229357798e-06, "loss": 3.53868408203125, "step": 360 }, { "epoch": 1.7000575705238918, "grad_norm": 11.724701881408691, "learning_rate": 7.68348623853211e-06, "loss": 4.154517364501953, "step": 370 }, { "epoch": 1.7461139896373057, "grad_norm": 9.129546165466309, "learning_rate": 6.536697247706422e-06, "loss": 3.2864849090576174, "step": 380 }, { "epoch": 1.7921704087507195, "grad_norm": 18.702472686767578, "learning_rate": 5.389908256880735e-06, "loss": 3.455213928222656, "step": 390 }, { "epoch": 1.8382268278641336, "grad_norm": 6.347196578979492, "learning_rate": 4.2431192660550464e-06, "loss": 3.5554222106933593, "step": 400 }, { "epoch": 1.8842832469775475, "grad_norm": 10.64411735534668, "learning_rate": 3.096330275229358e-06, "loss": 3.60513916015625, "step": 410 }, { "epoch": 1.9303396660909615, "grad_norm": 9.20349407196045, "learning_rate": 1.94954128440367e-06, "loss": 3.4330368041992188, "step": 420 }, { "epoch": 1.9763960852043754, "grad_norm": 18.204687118530273, "learning_rate": 8.027522935779817e-07, "loss": 4.128760910034179, "step": 430 }, { "epoch": 2.0, "eval_cer": 0.11358379197575177, "eval_loss": 0.45508942008018494, "eval_runtime": 56.7955, "eval_samples_per_second": 7.043, "eval_score": 72.5967427427653, "eval_steps_per_second": 1.761, "eval_wer": 0.4344813531689423, "step": 436 } ], "logging_steps": 10, "max_steps": 436, "num_input_tokens_seen": 0, "num_train_epochs": 2, "save_steps": 500, "stateful_callbacks": { "TrainerControl": { "args": { "should_epoch_stop": false, "should_evaluate": false, "should_log": false, "should_save": true, "should_training_stop": true }, "attributes": {} } }, "total_flos": 9.444793548642445e+18, "train_batch_size": 4, "trial_name": null, "trial_params": null }