Spaces:
Sleeping
Sleeping
Merge branch 'main' of https://huggingface.co/spaces/jaydatech/frb-chatbot
Browse files
app.py
CHANGED
|
@@ -3,7 +3,7 @@ from fastapi.middleware.cors import CORSMiddleware
|
|
| 3 |
from pydantic import BaseModel
|
| 4 |
from typing import List, Optional
|
| 5 |
import torch
|
| 6 |
-
from transformers import AutoModelForCausalLM, AutoTokenizer,
|
| 7 |
import re
|
| 8 |
import os
|
| 9 |
|
|
@@ -29,8 +29,8 @@ HF_TOKEN = os.getenv("HF_TOKEN") # Load from Render environment variable
|
|
| 29 |
|
| 30 |
device = "cuda" if torch.cuda.is_available() else "cpu"
|
| 31 |
|
| 32 |
-
|
| 33 |
-
tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
|
| 34 |
|
| 35 |
model = AutoModelForCausalLM.from_pretrained(
|
| 36 |
REPO_NAME,
|
|
|
|
| 3 |
from pydantic import BaseModel
|
| 4 |
from typing import List, Optional
|
| 5 |
import torch
|
| 6 |
+
from transformers import AutoModelForCausalLM, AutoTokenizer, LlamaTokenizerFast
|
| 7 |
import re
|
| 8 |
import os
|
| 9 |
|
|
|
|
| 29 |
|
| 30 |
device = "cuda" if torch.cuda.is_available() else "cpu"
|
| 31 |
|
| 32 |
+
tokenizer = LlamaTokenizerFast.from_pretrained(REPO_NAME, token=HF_TOKEN)
|
| 33 |
+
#tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
|
| 34 |
|
| 35 |
model = AutoModelForCausalLM.from_pretrained(
|
| 36 |
REPO_NAME,
|