Collections
Discover the best community collections!
Collections trending this week
-
Dissociating language and thought in large language models: a cognitive perspective
Paper • 2301.06627 • Published • 1 -
A Latent Space Theory for Emergent Abilities in Large Language Models
Paper • 2304.09960 • Published • 3 -
Are Emergent Abilities of Large Language Models a Mirage?
Paper • 2304.15004 • Published • 8 -
Do LLMs Really Adapt to Domains? An Ontology Learning Perspective
Paper • 2407.19998 • Published • 1
-
speakleash/Bielik-11B-v2.3-Instruct
Text Generation • 11B • Updated • 9.66k • 52 -
speakleash/Bielik-11B-v2.3-Instruct-FP8
Text Generation • 11B • Updated • 78 -
speakleash/Bielik-11B-v2.3-Instruct-4bit-ov
Text Generation • Updated • 34 • 2 -
speakleash/Bielik-11B-v2.3-Instruct-GGUF
Text Generation • 11B • Updated • 5.44k • 27
-
Qwen2.5 Technical Report
Paper • 2412.15115 • Published • 381 -
Qwen/Qwen2.5-0.5B
Text Generation • 0.5B • Updated • 2.39M • • 438 -
Qwen/Qwen2.5-0.5B-Instruct
Text Generation • 0.5B • Updated • 6.91M • • 597 -
Qwen/Qwen2.5-1.5B
Text Generation • 2B • Updated • 1.02M • 205
-
Dissociating language and thought in large language models: a cognitive perspective
Paper • 2301.06627 • Published • 1 -
A Latent Space Theory for Emergent Abilities in Large Language Models
Paper • 2304.09960 • Published • 3 -
Are Emergent Abilities of Large Language Models a Mirage?
Paper • 2304.15004 • Published • 8 -
Do LLMs Really Adapt to Domains? An Ontology Learning Perspective
Paper • 2407.19998 • Published • 1
-
speakleash/Bielik-11B-v2.3-Instruct
Text Generation • 11B • Updated • 9.66k • 52 -
speakleash/Bielik-11B-v2.3-Instruct-FP8
Text Generation • 11B • Updated • 78 -
speakleash/Bielik-11B-v2.3-Instruct-4bit-ov
Text Generation • Updated • 34 • 2 -
speakleash/Bielik-11B-v2.3-Instruct-GGUF
Text Generation • 11B • Updated • 5.44k • 27
-
Qwen2.5 Technical Report
Paper • 2412.15115 • Published • 381 -
Qwen/Qwen2.5-0.5B
Text Generation • 0.5B • Updated • 2.39M • • 438 -
Qwen/Qwen2.5-0.5B-Instruct
Text Generation • 0.5B • Updated • 6.91M • • 597 -
Qwen/Qwen2.5-1.5B
Text Generation • 2B • Updated • 1.02M • 205