Collections
Discover the best community collections!
Collections trending this week
-
Rethinking Interpretability in the Era of Large Language Models
Paper • 2402.01761 • Published • 23 -
OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models
Paper • 2402.01739 • Published • 28 -
BitNet: Scaling 1-bit Transformers for Large Language Models
Paper • 2310.11453 • Published • 108 -
Stealing Part of a Production Language Model
Paper • 2403.06634 • Published • 90
-
Adapting Large Language Models via Reading Comprehension
Paper • 2309.09530 • Published • 82 -
LLaMA: Open and Efficient Foundation Language Models
Paper • 2302.13971 • Published • 25 -
Finetuned Language Models Are Zero-Shot Learners
Paper • 2109.01652 • Published • 5 -
LIMA: Less Is More for Alignment
Paper • 2305.11206 • Published • 27
-
Adapting Large Language Models via Reading Comprehension
Paper • 2309.09530 • Published • 82 -
LLaMA: Open and Efficient Foundation Language Models
Paper • 2302.13971 • Published • 25 -
Finetuned Language Models Are Zero-Shot Learners
Paper • 2109.01652 • Published • 5 -
LIMA: Less Is More for Alignment
Paper • 2305.11206 • Published • 27
-
Rethinking Interpretability in the Era of Large Language Models
Paper • 2402.01761 • Published • 23 -
OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models
Paper • 2402.01739 • Published • 28 -
BitNet: Scaling 1-bit Transformers for Large Language Models
Paper • 2310.11453 • Published • 108 -
Stealing Part of a Production Language Model
Paper • 2403.06634 • Published • 90