imravi commited on
Commit
cd2a36b
·
verified ·
1 Parent(s): c3082f7

Update Dockerfile

Browse files
Files changed (1) hide show
  1. Dockerfile +4 -7
Dockerfile CHANGED
@@ -47,15 +47,13 @@ from sentence_transformers import SentenceTransformer
47
  from transformers import AutoTokenizer, AutoModelForCausalLM
48
  import torch
49
 
50
- # Download and save sentence transformer model
51
  print("Downloading sentence transformer model...")
52
  model = SentenceTransformer("sentence-transformers/all-mpnet-base-v2")
53
  model.save("/app/models/sentence_transformer")
54
- print("Sentence transformer model saved successfully!")
55
 
56
- # Download and save Qwen model and tokenizer
57
- print("Downloading Qwen model and tokenizer...")
58
- model_name = "Qwen/Qwen3.5-0.8B-Instruct"
59
  tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
60
  model = AutoModelForCausalLM.from_pretrained(
61
  model_name,
@@ -63,10 +61,9 @@ model = AutoModelForCausalLM.from_pretrained(
63
  torch_dtype=torch.float16,
64
  device_map=None
65
  )
66
-
67
  tokenizer.save_pretrained("/app/models/qwen")
68
  model.save_pretrained("/app/models/qwen")
69
- print("Qwen model and tokenizer saved successfully!")
70
  EOF
71
 
72
  # Download models during build
 
47
  from transformers import AutoTokenizer, AutoModelForCausalLM
48
  import torch
49
 
 
50
  print("Downloading sentence transformer model...")
51
  model = SentenceTransformer("sentence-transformers/all-mpnet-base-v2")
52
  model.save("/app/models/sentence_transformer")
53
+ print("Sentence transformer model saved!")
54
 
55
+ print("Downloading Qwen model...")
56
+ model_name = "Qwen/Qwen2.5-0.5B-Instruct" # Fixed: was Qwen3.5 (doesn't exist)
 
57
  tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True)
58
  model = AutoModelForCausalLM.from_pretrained(
59
  model_name,
 
61
  torch_dtype=torch.float16,
62
  device_map=None
63
  )
 
64
  tokenizer.save_pretrained("/app/models/qwen")
65
  model.save_pretrained("/app/models/qwen")
66
+ print("Qwen model saved!")
67
  EOF
68
 
69
  # Download models during build