Instructions to use NbAiLab/nb-gpt-j-6B with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use NbAiLab/nb-gpt-j-6B with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-generation", model="NbAiLab/nb-gpt-j-6B")# Load model directly from transformers import AutoTokenizer, AutoModelForCausalLM tokenizer = AutoTokenizer.from_pretrained("NbAiLab/nb-gpt-j-6B") model = AutoModelForCausalLM.from_pretrained("NbAiLab/nb-gpt-j-6B", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- vLLM
How to use NbAiLab/nb-gpt-j-6B with vLLM:
Install from pip and serve model
# Install vLLM from pip: pip install vllm # Start the vLLM server: vllm serve "NbAiLab/nb-gpt-j-6B" # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:8000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "NbAiLab/nb-gpt-j-6B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker
docker model run hf.co/NbAiLab/nb-gpt-j-6B
- SGLang
How to use NbAiLab/nb-gpt-j-6B with SGLang:
Install from pip and serve model
# Install SGLang from pip: pip install sglang # Start the SGLang server: python3 -m sglang.launch_server \ --model-path "NbAiLab/nb-gpt-j-6B" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "NbAiLab/nb-gpt-j-6B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker images
docker run --gpus all \ --shm-size 32g \ -p 30000:30000 \ -v ~/.cache/huggingface:/root/.cache/huggingface \ --env "HF_TOKEN=<secret>" \ --ipc=host \ lmsysorg/sglang:latest \ python3 -m sglang.launch_server \ --model-path "NbAiLab/nb-gpt-j-6B" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "NbAiLab/nb-gpt-j-6B", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }' - Docker Model Runner
How to use NbAiLab/nb-gpt-j-6B with Docker Model Runner:
docker model run hf.co/NbAiLab/nb-gpt-j-6B
OSError: Unable to load weights from pytorch checkpoint file
Hei! Jeg får denne feilen når jeg prøver å laste inn modellen:
OSError: Unable to load weights from pytorch checkpoint file for '/root/.cache/huggingface/hub/models--NbAiLab--nb-gpt-j-6B/snapshots/05b044b9e8bdc8e0992e274713d72a7d4a1c2d2f/pytorch_model.bin' at '/root/.cache/huggingface/hub/models--NbAiLab--nb-gpt-j-6B/snapshots/05b044b9e8bdc8e0992e274713d72a7d4a1c2d2f/pytorch_model.bin'. If you tried to load a PyTorch model from a TF 2.0 checkpoint, please set from_tf=True.
Jeg bruker den koden som ligger på modellsiden for å laste den inn:
from transformers import AutoTokenizer, AutoModelForCausalLM
tokenizer = AutoTokenizer.from_pretrained("NbAiLab/nb-gpt-j-6B")
model = AutoModelForCausalLM.from_pretrained("NbAiLab/nb-gpt-j-6B")
Jeg har transformers==4.26.0 og kjører i Google Colab. Har klart å laste inn andre modeller som er AutoModelForCausalLM, for eksempel bigscience/mt0-small. Har dette noe å gjøre med hvilken versjon av transformers/torch jeg har, eller må jeg kanskje laste inn modellen på en annen måte?
Hei! Jeg har nettopp testet den og den fungerer OK med transformers==4.26.1 and torch==1.10.1. Ikke sikker på om du får plass til modellen i Colabs GPU.
from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline
tokenizer = AutoTokenizer.from_pretrained("NbAiLab/nb-gpt-j-6B")
model = AutoModelForCausalLM.from_pretrained("NbAiLab/nb-gpt-j-6B")
pipe = pipeline("text-generation", model=model, tokenizer=tokenizer)
pipe("Jeg leser en bok om")
# [{'generated_text': 'Jeg leser en bok om en hund som ser på meg og ikke på andre som den går forbi, men noen ganger er det mennesker som kikker på meg'}]
Kanskje prøve å slette cachen din?
Hei, får samme feil som @ilang . Har prøvd både å slette cache og bruke versjoner: transformers==4.26.1 og torch==1.10.1. Jeg kjører koden i jupyter notebook med python-versjon 3.9.
Jeg bruker også Python 3.9. Kan du laste EleutherAI/gpt-j-6B eller får du også en feilmelding?