OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated Jul 22
OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated Jul 22
OLMo-2-1B Midtrained Collection Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting Ishaan Watts*, Catherine Li*, Sachin Goyal, Jacob Mitchell Springer, Aditi Raghunathan • 3 items • Updated Jul 22
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks Paper • 2311.07463 • Published Nov 13, 2023 • 14