Spaces:
Sleeping
Sleeping
first commit
Browse files- .gitattributes +1 -0
- app.py +35 -0
- model/added_tokens.json +3 -0
- model/config.json +3 -0
- model/eval_results.txt +1 -0
- model/generation_config.json +3 -0
- model/merges.txt +0 -0
- model/pytorch_model.bin +3 -0
- model/special_tokens_map.json +3 -0
- model/tokenizer.json +3 -0
- model/tokenizer_config.json +3 -0
- model/training_args.bin +3 -0
- model/vocab.json +3 -0
- requirements.txt +3 -0
.gitattributes
CHANGED
|
@@ -33,3 +33,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 33 |
*.zip filter=lfs diff=lfs merge=lfs -text
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
| 33 |
*.zip filter=lfs diff=lfs merge=lfs -text
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
+
*.json filter=lfs diff=lfs merge=lfs -text
|
app.py
ADDED
|
@@ -0,0 +1,35 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
import gradio as gr
|
| 2 |
+
from transformers import AutoModelWithLMHead, AutoTokenizer
|
| 3 |
+
import torch
|
| 4 |
+
|
| 5 |
+
def flatten(l):
|
| 6 |
+
return [item for sublist in l for item in sublist]
|
| 7 |
+
|
| 8 |
+
tokenizer = AutoTokenizer.from_pretrained("model")
|
| 9 |
+
model = AutoModelWithLMHead.from_pretrained("model")
|
| 10 |
+
|
| 11 |
+
with gr.Blocks() as demo:
|
| 12 |
+
chatbot = gr.Chatbot()
|
| 13 |
+
msg = gr.Textbox()
|
| 14 |
+
clear = gr.ClearButton([msg, chatbot])
|
| 15 |
+
|
| 16 |
+
def respond(message, chat_history):
|
| 17 |
+
input_ids = tokenizer.encode(message + tokenizer.eos_token, return_tensors='pt')
|
| 18 |
+
if len(chat_history):
|
| 19 |
+
tokenized_chat_history = [tokenizer.encode(x + tokenizer.eos_token, return_tensors='pt')[0] for x in flatten(chat_history)]
|
| 20 |
+
tokenized_chat_history = torch.cat(tokenized_chat_history).unsqueeze(0)
|
| 21 |
+
bot_input_ids = torch.cat([tokenized_chat_history, input_ids], dim=-1) if len(chat_history) else input_ids
|
| 22 |
+
output = model.generate(
|
| 23 |
+
bot_input_ids,
|
| 24 |
+
max_new_tokens=50,
|
| 25 |
+
pad_token_id=tokenizer.eos_token_id,
|
| 26 |
+
do_sample=True,
|
| 27 |
+
top_k=50,
|
| 28 |
+
top_p=0.95,
|
| 29 |
+
)
|
| 30 |
+
bot_message = str(tokenizer.decode(output[:, bot_input_ids.shape[-1]:][0], skip_special_tokens=True))
|
| 31 |
+
chat_history.append((message, bot_message))
|
| 32 |
+
return "", chat_history
|
| 33 |
+
msg.submit(respond, [msg, chatbot], [msg, chatbot])
|
| 34 |
+
|
| 35 |
+
demo.launch()
|
model/added_tokens.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:45618a46ae539c9ff102239db581a014f77f6dcd76a3cf6ef92e08223d25de68
|
| 3 |
+
size 24
|
model/config.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:410b155448976f61f3c5a36732411b49df18839c8f6b84b16080c5ed6c817fee
|
| 3 |
+
size 948
|
model/eval_results.txt
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
loss = tensor(2.4251)
|
model/generation_config.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3854cdd3fd2790a634d50e21520681f0ca1eca532df38b35dd10f7af176e2860
|
| 3 |
+
size 125
|
model/merges.txt
ADDED
|
The diff for this file is too large to render.
See raw diff
|
|
|
model/pytorch_model.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0f3b56c3412583582d423f14b29502b09619ba65486a6c0fd15f5bebe8e4f936
|
| 3 |
+
size 1419391965
|
model/special_tokens_map.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3571944d01dcab472528bad2e0a358bac38fd385ba5d499f2a9892043da0f8b6
|
| 3 |
+
size 486
|
model/tokenizer.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:a2f683f0962ce6bc4f1488383ae983a11ebc689bd3ffd963c14c3117831cd545
|
| 3 |
+
size 2107833
|
model/tokenizer_config.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:bb7378573bdde7414178d6d207843c0aecb37f314085ada2adadb64602ef5870
|
| 3 |
+
size 760
|
model/training_args.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:2015d34d755eed00335e05d6536772d06dfa1bd32871d27ce87746d177a87c0a
|
| 3 |
+
size 1147
|
model/vocab.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3ba3c3109ff33976c4bd966589c11ee14fcaa1f4c9e5e154c2ed7f99d80709e7
|
| 3 |
+
size 798156
|
requirements.txt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
gradio==3.38.0
|
| 2 |
+
transformers==4.30.2
|
| 3 |
+
torch==2.0.1
|