How to use from
Docker Model Runner
docker model run hf.co/4darsh-Dev/Meta-Llama-3-8B-quantized-GPTQ
Quick Links

Model Card for 4darsh-Dev/Meta-Llama-3-8B-autogptq-4bit

This repo contains 4-bit quantized (using autogptq and peft) model of Meta's Meta-Llama-3-8B

Model Details

Downloads last month
-
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support