Spaces:
Sleeping
Sleeping
Update app.py
Browse files
app.py
CHANGED
|
@@ -3,7 +3,7 @@ from fastapi.middleware.cors import CORSMiddleware
|
|
| 3 |
from pydantic import BaseModel
|
| 4 |
from typing import List, Optional
|
| 5 |
import torch
|
| 6 |
-
from transformers import AutoModelForCausalLM, AutoTokenizer,
|
| 7 |
import re
|
| 8 |
import os
|
| 9 |
|
|
@@ -29,7 +29,7 @@ HF_TOKEN = os.getenv("HF_TOKEN") # Load from Render environment variable
|
|
| 29 |
|
| 30 |
device = "cuda" if torch.cuda.is_available() else "cpu"
|
| 31 |
|
| 32 |
-
tokenizer =
|
| 33 |
#tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
|
| 34 |
|
| 35 |
model = AutoModelForCausalLM.from_pretrained(
|
|
|
|
| 3 |
from pydantic import BaseModel
|
| 4 |
from typing import List, Optional
|
| 5 |
import torch
|
| 6 |
+
from transformers import AutoModelForCausalLM, AutoTokenizer, LlamaTokenizerFast
|
| 7 |
import re
|
| 8 |
import os
|
| 9 |
|
|
|
|
| 29 |
|
| 30 |
device = "cuda" if torch.cuda.is_available() else "cpu"
|
| 31 |
|
| 32 |
+
tokenizer = LlamaTokenizerFast.from_pretrained(REPO_NAME, token=HF_TOKEN)
|
| 33 |
#tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
|
| 34 |
|
| 35 |
model = AutoModelForCausalLM.from_pretrained(
|