CompendiumLabs
/

mistral-nemo-instruct-2407-gguf

Model card Files Files and versions

mistral-nemo-instruct-2407-gguf / README.md

iamlemec's picture

Update README.md

23aa596 verified over 1 year ago

|

history blame contribute delete

534 Bytes

	---
	license: apache-2.0
	---

	This is a quantized GGUF of [mistralai/Mistral-Nemo-Instruct-2407](https://huggingface.co/mistralai/Mistral-Nemo-Instruct-2407). Requires `llama.cpp` newer than commit `50e0535` (7/22/2024) to run inference.

	Currently, we just have a [`Q5_K`](https://huggingface.co/CompendiumLabs/mistral-nemo-instruct-2407-gguf/blob/main/mistral-nemo-instruct-q5_k.gguf) quantization which comes in at 8.73 GB. If you're interested other quantizations, just ping me [@iamlemec](https://twitter.com/iamlemec) on Twitter.