Fix chatbot message format for Gradio 4.x compatibility 1510146 verified drewinspirit commited on Mar 19
Upload Training language models to follow instructions with human feedback.pdf db53d0d verified drewinspirit commited on Mar 18
Upload Language Models are unsupervised Multitask Learners.pdf 145e9b1 verified drewinspirit commited on Mar 18
Upload RLAIF- Scaling Reinforcement Learning from Human Feedback with AI Feedback.pdf 85482d3 verified drewinspirit commited on Mar 18
Upload System 2 Attention (is something you might need too).pdf fd78975 verified drewinspirit commited on Mar 18
Upload Direct Preference Optimization- Your Language Model is Secretly a Reward Model.pdf fd796b1 verified drewinspirit commited on Mar 18
Upload Training Compute-Optimal Large Language Models.pdf 57a9e37 verified drewinspirit commited on Mar 18
Upload Chain-of-Thought Prompting Elicits Reasoning in Large Language Models .pdf 9a516a7 verified drewinspirit commited on Mar 18
Upload Tree of Thoughts- Deliberate Problem Solving with Large Language Models.pdf 35ddc0e verified drewinspirit commited on Mar 18
Upload Sparks of Artificial General Intelligence- Early experiments with GPT-4.pdf 98685b2 verified drewinspirit commited on Mar 18
Upload Llama 2 - Open Foundation and Fine-Tuned Chat Models.pdf 44f49a0 verified drewinspirit commited on Mar 18