ayushadarsh7 commited on
Commit
9bcdaf9
·
verified ·
1 Parent(s): 995a946

Create HyperParameters.md

Browse files
Files changed (1) hide show
  1. HyperParameters.md +27 -0
HyperParameters.md ADDED
@@ -0,0 +1,27 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ parser = argparse.ArgumentParser(description="Train Gemma model with LoRA")
2
+ parser.add_argument("--model_id", type=str, default="google/gemma-3-4b-it",
3
+ help="Base model ID (default: google/gemma-3-4b-it)")
4
+ parser.add_argument("--processor_id", type=str, default="google/gemma-3-4b-it",
5
+ help="Processor ID (default: google/gemma-3-4b-it)")
6
+ parser.add_argument("--train_jsonl", type=str, required=True,
7
+ help="Path to training JSONL file")
8
+ parser.add_argument("--output_dir", type=str, default="gemma-zipper-lora",
9
+ help="Output directory (default: gemma-zipper-lora)")
10
+ parser.add_argument("--hub_repo", type=str, default="ayushadarsh7/gemma3_lora",
11
+ help="HuggingFace Hub repository name (e.g., username/model-name)")
12
+ parser.add_argument("--num_epochs", type=int, default=3,
13
+ help="Number of training epochs (default: 3)")
14
+ parser.add_argument("--batch_size", type=int, default=1,
15
+ help="Batch size per device (default: 1)")
16
+ parser.add_argument("--gradient_accumulation_steps", type=int, default=4,
17
+ help="Gradient accumulation steps (default: 4)")
18
+ parser.add_argument("--learning_rate", type=float, default=2e-4,
19
+ help="Learning rate (default: 2e-4)")
20
+ parser.add_argument("--lora_r", type=int, default=16,
21
+ help="LoRA r parameter (default: 16)")
22
+ parser.add_argument("--lora_alpha", type=int, default=16,
23
+ help="LoRA alpha parameter (default: 16)")
24
+ parser.add_argument("--merge_and_save", action="store_true",
25
+ help="Merge LoRA adapter with base model and save")
26
+
27
+