Cristobal299 commited on
Commit
2d3af6f
·
verified ·
1 Parent(s): 454a7d7

Upload 2 files

Browse files
Files changed (2) hide show
  1. README.md +2 -1
  2. app.py +3 -3
README.md CHANGED
@@ -8,12 +8,13 @@ sdk_version: "5.29.0"
8
  app_file: app.py
9
  pinned: true
10
  license: mit
 
11
  ---
12
 
13
  # 🧠 Fénix Brain
14
 
15
  LLM de código para La Forja de Fénix.
16
- Modelo: **Qwen2.5-Coder-14B-Instruct** · GPU: ZeroGPU
17
 
18
  ## API
19
 
 
8
  app_file: app.py
9
  pinned: true
10
  license: mit
11
+ hardware: zero-gpu
12
  ---
13
 
14
  # 🧠 Fénix Brain
15
 
16
  LLM de código para La Forja de Fénix.
17
+ Modelo: **Qwen2.5-Coder-7B-Instruct** · GPU: ZeroGPU
18
 
19
  ## API
20
 
app.py CHANGED
@@ -9,15 +9,15 @@ import gradio as gr
9
  from transformers import AutoTokenizer, AutoModelForCausalLM
10
  import torch
11
 
12
- MODEL_ID = "Qwen/Qwen2.5-Coder-14B-Instruct"
13
  API_KEY = os.environ.get("BRAIN_API_KEY", "")
14
 
15
  # ── Cargar modelo al arranque (requerido por ZeroGPU) ─────────────────────────
16
  tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, trust_remote_code=True)
17
  model = AutoModelForCausalLM.from_pretrained(
18
  MODEL_ID,
19
- torch_dtype=torch.bfloat16,
20
- device_map="cpu", # ZeroGPU mueve a GPU solo cuando entra al decorador
21
  trust_remote_code=True,
22
  )
23
 
 
9
  from transformers import AutoTokenizer, AutoModelForCausalLM
10
  import torch
11
 
12
+ MODEL_ID = "Qwen/Qwen2.5-Coder-7B-Instruct"
13
  API_KEY = os.environ.get("BRAIN_API_KEY", "")
14
 
15
  # ── Cargar modelo al arranque (requerido por ZeroGPU) ─────────────────────────
16
  tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, trust_remote_code=True)
17
  model = AutoModelForCausalLM.from_pretrained(
18
  MODEL_ID,
19
+ dtype=torch.bfloat16,
20
+ device_map="cpu",
21
  trust_remote_code=True,
22
  )
23