Text Generation
Transformers
Safetensors
GGUF
English
llama-3.2-1B-Instruct
llama.cpp
conversational

Commit History

Model card: expand measured performance with end-to-end runtime comparison (PyTorch vs llama.cpp) and bandwidth/compute-bound explanation
7c697d6
verified

cycloevan commited on

Model card: add measured quantization quality (ROUGE-L/BLEU, 100 samples) and llama-bench performance
31fb51f
verified

cycloevan commited on

Add GGUF quantized builds (Q4_K_M, Q8_0) for llama.cpp on-device inference
6d75657
verified

cycloevan commited on

Update README.md
e04979e
verified

cycloevan commited on

Update README.md
514849b
verified

cycloevan commited on

Upload 11 files
ab1c015
verified

cycloevan commited on

update README
a386d63
verified

cycloevan commited on

update README
c5aa321
verified

cycloevan commited on

initial commit
906a936
verified

cycloevan commited on