Collections
Discover the best community collections!
Collections trending this week
-
OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models
Paper • 2308.01390 • Published • 34 -
Med-Flamingo: a Multimodal Medical Few-shot Learner
Paper • 2307.15189 • Published • 24 -
BuboGPT: Enabling Visual Grounding in Multi-Modal LLMs
Paper • 2307.08581 • Published • 29 -
GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest
Paper • 2307.03601 • Published • 13
-
Large Language Models as Optimizers
Paper • 2309.03409 • Published • 79 -
Mixture-of-Depths: Dynamically allocating compute in transformer-based language models
Paper • 2404.02258 • Published • 107 -
OpenELM: An Efficient Language Model Family with Open-source Training and Inference Framework
Paper • 2404.14619 • Published • 126 -
Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone
Paper • 2404.14219 • Published • 262
-
Nougat: Neural Optical Understanding for Academic Documents
Paper • 2308.13418 • Published • 42 -
mPLUG-DocOwl: Modularized Multimodal Large Language Model for Document Understanding
Paper • 2307.02499 • Published • 16 -
Text Rendering Strategies for Pixel Language Models
Paper • 2311.00522 • Published • 11
-
DunnBC22/yolos-small-Axial_MRIs
Object Detection • Updated • 10 • 2 -
DunnBC22/bert-base-cased-finetuned-ner-BC2GM-IOB
Token Classification • Updated • 1 • 1 -
DunnBC22/efficientnet-b5-Brain_Tumors_Image_Classification
Image Classification • Updated • 4 -
DunnBC22/vit-base-patch16-224-in21k_lung_and_colon_cancer
Image Classification • Updated • 1.89k • • 7
-
OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models
Paper • 2308.01390 • Published • 34 -
Med-Flamingo: a Multimodal Medical Few-shot Learner
Paper • 2307.15189 • Published • 24 -
BuboGPT: Enabling Visual Grounding in Multi-Modal LLMs
Paper • 2307.08581 • Published • 29 -
GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest
Paper • 2307.03601 • Published • 13
-
Large Language Models as Optimizers
Paper • 2309.03409 • Published • 79 -
Mixture-of-Depths: Dynamically allocating compute in transformer-based language models
Paper • 2404.02258 • Published • 107 -
OpenELM: An Efficient Language Model Family with Open-source Training and Inference Framework
Paper • 2404.14619 • Published • 126 -
Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone
Paper • 2404.14219 • Published • 262
-
Nougat: Neural Optical Understanding for Academic Documents
Paper • 2308.13418 • Published • 42 -
mPLUG-DocOwl: Modularized Multimodal Large Language Model for Document Understanding
Paper • 2307.02499 • Published • 16 -
Text Rendering Strategies for Pixel Language Models
Paper • 2311.00522 • Published • 11
-
DunnBC22/yolos-small-Axial_MRIs
Object Detection • Updated • 10 • 2 -
DunnBC22/bert-base-cased-finetuned-ner-BC2GM-IOB
Token Classification • Updated • 1 • 1 -
DunnBC22/efficientnet-b5-Brain_Tumors_Image_Classification
Image Classification • Updated • 4 -
DunnBC22/vit-base-patch16-224-in21k_lung_and_colon_cancer
Image Classification • Updated • 1.89k • • 7