alg_name: "LoRA" model_name: "llava-hf/llava-1.5-7b-hf" device: 0 # LoRA settings lora_type: "lora" layers: [] kl_factor: 0 norm_constraint: false rank: 16 lora_alpha: 32 lora_dropout: 0.05 target_modules: ["q_proj", "v_proj"] # Training settings num_steps: 5 batch_size: 1 max_length: 30 lr: 1e-1 sh_lr: 0.9 weight_decay: 0.0 model_parallel: False use_chat_template: True