electblake's picture
Enable ZeroGPU inference
af4ba2c verified
Raw
History Blame Contribute Delete
421 Bytes
import gradio as gr
from transformers import pipeline
import spaces
pipe = pipeline(
"text-generation", model="Spreadsheet-RL/Spreadsheet-RL-4B", device="cuda"
)
@spaces.GPU
def generate(prompt):
messages = [
{"role": "user", "content": prompt},
]
return pipe(messages, max_new_tokens=40)[0]["generated_text"][-1]["content"]
gr.Interface(fn=generate, inputs="text", outputs="text").launch()