berkeley-nest
/

Transformers
PyTorch
English
llama
reward model
RLHF
RLAIF
text-generation-inference
amitness's picture
Fix issues in sample code: Invalid reward_tokenizer and issue in returning scores
f9c3ba8