from model import load_model, load_tokenizer, run model = load_model("QED-Base-v2.pt") tokenizer = load_tokenizer("tok.model") text = run("The future of ai will be", model, tokenizer, max_new_tokens=100) print(text)