Instructions to use badrben/Arabic_Open_Questions_5_6 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use badrben/Arabic_Open_Questions_5_6 with PEFT:
from peft import PeftModel from transformers import AutoModelForSeq2SeqLM base_model = AutoModelForSeq2SeqLM.from_pretrained("google/flan-t5-large") model = PeftModel.from_pretrained(base_model, "badrben/Arabic_Open_Questions_5_6") - Transformers
How to use badrben/Arabic_Open_Questions_5_6 with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("badrben/Arabic_Open_Questions_5_6", device_map="auto") - Notebooks
- Google Colab
- Kaggle
| { | |
| "best_global_step": 285, | |
| "best_metric": 16.371719360351562, | |
| "best_model_checkpoint": "./mbart-large-50-finetuned-question-generation-arab/checkpoint-285", | |
| "epoch": 19.0, | |
| "eval_steps": 500, | |
| "global_step": 285, | |
| "is_hyper_param_search": false, | |
| "is_local_process_zero": true, | |
| "is_world_process_zero": true, | |
| "log_history": [ | |
| { | |
| "epoch": 1.0, | |
| "eval_loss": 37.02599334716797, | |
| "eval_runtime": 5.1623, | |
| "eval_samples_per_second": 5.811, | |
| "eval_steps_per_second": 1.55, | |
| "step": 15 | |
| }, | |
| { | |
| "epoch": 2.0, | |
| "eval_loss": 35.49879455566406, | |
| "eval_runtime": 5.292, | |
| "eval_samples_per_second": 5.669, | |
| "eval_steps_per_second": 1.512, | |
| "step": 30 | |
| }, | |
| { | |
| "epoch": 3.0, | |
| "eval_loss": 34.025047302246094, | |
| "eval_runtime": 5.4264, | |
| "eval_samples_per_second": 5.529, | |
| "eval_steps_per_second": 1.474, | |
| "step": 45 | |
| }, | |
| { | |
| "epoch": 3.3333333333333335, | |
| "grad_norm": 8.457286834716797, | |
| "learning_rate": 2.608e-05, | |
| "loss": 34.8404, | |
| "step": 50 | |
| }, | |
| { | |
| "epoch": 4.0, | |
| "eval_loss": 32.63771438598633, | |
| "eval_runtime": 5.2783, | |
| "eval_samples_per_second": 5.684, | |
| "eval_steps_per_second": 1.516, | |
| "step": 60 | |
| }, | |
| { | |
| "epoch": 5.0, | |
| "eval_loss": 31.108373641967773, | |
| "eval_runtime": 5.1216, | |
| "eval_samples_per_second": 5.858, | |
| "eval_steps_per_second": 1.562, | |
| "step": 75 | |
| }, | |
| { | |
| "epoch": 6.0, | |
| "eval_loss": 29.284595489501953, | |
| "eval_runtime": 5.1789, | |
| "eval_samples_per_second": 5.793, | |
| "eval_steps_per_second": 1.545, | |
| "step": 90 | |
| }, | |
| { | |
| "epoch": 6.666666666666667, | |
| "grad_norm": 10.995285034179688, | |
| "learning_rate": 2.208e-05, | |
| "loss": 30.0211, | |
| "step": 100 | |
| }, | |
| { | |
| "epoch": 7.0, | |
| "eval_loss": 27.029993057250977, | |
| "eval_runtime": 5.2918, | |
| "eval_samples_per_second": 5.669, | |
| "eval_steps_per_second": 1.512, | |
| "step": 105 | |
| }, | |
| { | |
| "epoch": 8.0, | |
| "eval_loss": 24.575008392333984, | |
| "eval_runtime": 5.4135, | |
| "eval_samples_per_second": 5.542, | |
| "eval_steps_per_second": 1.478, | |
| "step": 120 | |
| }, | |
| { | |
| "epoch": 9.0, | |
| "eval_loss": 22.200883865356445, | |
| "eval_runtime": 5.345, | |
| "eval_samples_per_second": 5.613, | |
| "eval_steps_per_second": 1.497, | |
| "step": 135 | |
| }, | |
| { | |
| "epoch": 10.0, | |
| "grad_norm": 8.086270332336426, | |
| "learning_rate": 1.808e-05, | |
| "loss": 24.3026, | |
| "step": 150 | |
| }, | |
| { | |
| "epoch": 10.0, | |
| "eval_loss": 19.888904571533203, | |
| "eval_runtime": 5.1154, | |
| "eval_samples_per_second": 5.865, | |
| "eval_steps_per_second": 1.564, | |
| "step": 150 | |
| }, | |
| { | |
| "epoch": 11.0, | |
| "eval_loss": 18.55392837524414, | |
| "eval_runtime": 5.1417, | |
| "eval_samples_per_second": 5.835, | |
| "eval_steps_per_second": 1.556, | |
| "step": 165 | |
| }, | |
| { | |
| "epoch": 12.0, | |
| "eval_loss": 18.111530303955078, | |
| "eval_runtime": 5.2838, | |
| "eval_samples_per_second": 5.678, | |
| "eval_steps_per_second": 1.514, | |
| "step": 180 | |
| }, | |
| { | |
| "epoch": 13.0, | |
| "eval_loss": 17.66804313659668, | |
| "eval_runtime": 5.3688, | |
| "eval_samples_per_second": 5.588, | |
| "eval_steps_per_second": 1.49, | |
| "step": 195 | |
| }, | |
| { | |
| "epoch": 13.333333333333334, | |
| "grad_norm": 3.375803232192993, | |
| "learning_rate": 1.408e-05, | |
| "loss": 19.1154, | |
| "step": 200 | |
| }, | |
| { | |
| "epoch": 14.0, | |
| "eval_loss": 17.32933807373047, | |
| "eval_runtime": 5.34, | |
| "eval_samples_per_second": 5.618, | |
| "eval_steps_per_second": 1.498, | |
| "step": 210 | |
| }, | |
| { | |
| "epoch": 15.0, | |
| "eval_loss": 17.066261291503906, | |
| "eval_runtime": 5.1231, | |
| "eval_samples_per_second": 5.856, | |
| "eval_steps_per_second": 1.562, | |
| "step": 225 | |
| }, | |
| { | |
| "epoch": 16.0, | |
| "eval_loss": 16.871784210205078, | |
| "eval_runtime": 5.0824, | |
| "eval_samples_per_second": 5.903, | |
| "eval_steps_per_second": 1.574, | |
| "step": 240 | |
| }, | |
| { | |
| "epoch": 16.666666666666668, | |
| "grad_norm": 3.1058177947998047, | |
| "learning_rate": 1.008e-05, | |
| "loss": 17.5187, | |
| "step": 250 | |
| }, | |
| { | |
| "epoch": 17.0, | |
| "eval_loss": 16.67777442932129, | |
| "eval_runtime": 5.0899, | |
| "eval_samples_per_second": 5.894, | |
| "eval_steps_per_second": 1.572, | |
| "step": 255 | |
| }, | |
| { | |
| "epoch": 18.0, | |
| "eval_loss": 16.50282096862793, | |
| "eval_runtime": 5.2157, | |
| "eval_samples_per_second": 5.752, | |
| "eval_steps_per_second": 1.534, | |
| "step": 270 | |
| }, | |
| { | |
| "epoch": 19.0, | |
| "eval_loss": 16.371719360351562, | |
| "eval_runtime": 5.4033, | |
| "eval_samples_per_second": 5.552, | |
| "eval_steps_per_second": 1.481, | |
| "step": 285 | |
| } | |
| ], | |
| "logging_steps": 50, | |
| "max_steps": 375, | |
| "num_input_tokens_seen": 0, | |
| "num_train_epochs": 25, | |
| "save_steps": 500, | |
| "stateful_callbacks": { | |
| "TrainerControl": { | |
| "args": { | |
| "should_epoch_stop": false, | |
| "should_evaluate": false, | |
| "should_log": false, | |
| "should_save": true, | |
| "should_training_stop": false | |
| }, | |
| "attributes": {} | |
| } | |
| }, | |
| "total_flos": 5287920701276160.0, | |
| "train_batch_size": 2, | |
| "trial_name": null, | |
| "trial_params": null | |
| } | |