base-100k-sft-checkpoints / NT /H2AFZ /trainer_state.json
nancyH's picture
add baseline-100k SFT checkpoint: H2AFZ
9769c63 verified
Raw
History Blame Contribute Delete
2.57 kB
{
"best_metric": 0.7456807576708037,
"best_model_checkpoint": "/home/n5huang/dna_token/mario/best_hp_runs/Nucleotides_task/output_best_nt_base_5120_rerun/H2AFZ/base_5120/lr3e-5_wd0.03_wr0.03_ep4_seed42/checkpoint-621",
"epoch": 3.0,
"eval_steps": 100,
"global_step": 621,
"is_hyper_param_search": false,
"is_local_process_zero": true,
"is_world_process_zero": true,
"log_history": [
{
"epoch": 0.48,
"learning_rate": 2.7198007471980076e-05,
"loss": 0.5735,
"step": 100
},
{
"epoch": 0.97,
"learning_rate": 2.3462017434620174e-05,
"loss": 0.5274,
"step": 200
},
{
"epoch": 1.0,
"eval_accuracy": 0.7381818181818182,
"eval_f1": 0.7380571247139134,
"eval_loss": 0.510424017906189,
"eval_matthews_correlation": 0.4761799088394191,
"eval_precision": 0.7380206659012629,
"eval_recall": 0.7381592631082483,
"eval_runtime": 1.9839,
"eval_samples_per_second": 1663.4,
"eval_steps_per_second": 13.106,
"step": 207
},
{
"epoch": 1.45,
"learning_rate": 1.9726027397260273e-05,
"loss": 0.4865,
"step": 300
},
{
"epoch": 1.93,
"learning_rate": 1.5990037359900375e-05,
"loss": 0.4775,
"step": 400
},
{
"epoch": 2.0,
"eval_accuracy": 0.7451515151515151,
"eval_f1": 0.745150368445184,
"eval_loss": 0.5398480296134949,
"eval_matthews_correlation": 0.49169806706773844,
"eval_precision": 0.7458809876804688,
"eval_recall": 0.7458170835399596,
"eval_runtime": 1.9733,
"eval_samples_per_second": 1672.322,
"eval_steps_per_second": 13.176,
"step": 414
},
{
"epoch": 2.42,
"learning_rate": 1.2254047322540475e-05,
"loss": 0.4299,
"step": 500
},
{
"epoch": 2.9,
"learning_rate": 8.518057285180574e-06,
"loss": 0.4262,
"step": 600
},
{
"epoch": 3.0,
"eval_accuracy": 0.7463636363636363,
"eval_f1": 0.7456807576708037,
"eval_loss": 0.5254473090171814,
"eval_matthews_correlation": 0.5010849988794834,
"eval_precision": 0.7526557247616428,
"eval_recall": 0.7484469492418274,
"eval_runtime": 1.9776,
"eval_samples_per_second": 1668.651,
"eval_steps_per_second": 13.147,
"step": 621
}
],
"logging_steps": 100,
"max_steps": 828,
"num_train_epochs": 4,
"save_steps": 100,
"total_flos": 8953998102720000.0,
"trial_name": null,
"trial_params": null
}