mjf-su commited on
Commit
d968a11
·
verified ·
1 Parent(s): 9b64c90

Upload train_config.json with huggingface_hub

Browse files
Files changed (1) hide show
  1. train_config.json +34 -0
train_config.json ADDED
@@ -0,0 +1,34 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "train_dataset": "datasets/Faithfulness-Critic-Dataset/train_dataset.jsonl",
3
+ "val_dataset": "datasets/Faithfulness-Critic-Dataset/val_dataset.jsonl",
4
+ "dataset_dir": "datasets/Faithfulness-Critic-Dataset",
5
+ "max_length": 4096,
6
+ "seed": 0,
7
+ "eval_max_new_tokens": 32,
8
+ "eval_batch_size": 8,
9
+ "eval_steps": 531,
10
+ "scene_oversample_factor": 1.8,
11
+ "e1_oversample_factor": 3.2,
12
+ "base_model": "Qwen/Qwen3-VL-4B-Instruct",
13
+ "use_lora": true,
14
+ "lora_rank": 256,
15
+ "lora_alpha": null,
16
+ "lora_dropout": 0.05,
17
+ "lora_target_modules": "q_proj,k_proj,v_proj,o_proj",
18
+ "flash_attn": false,
19
+ "gradient_checkpointing": false,
20
+ "output_dir": "results/scene-critic-lora",
21
+ "epochs": 2.0,
22
+ "per_device_batch_size": 8,
23
+ "grad_accum_steps": 1,
24
+ "lr": 0.0001,
25
+ "warmup_ratio": 0.03,
26
+ "weight_decay": 0.0,
27
+ "logging_steps": 10,
28
+ "save_steps": 2656,
29
+ "save_total_limit": 2,
30
+ "max_steps": -1,
31
+ "report_to": "wandb",
32
+ "wandb_project": "Faithfulness-Critic",
33
+ "wandb_run_name": "completion-verdict"
34
+ }