feat(vLLM - KV cache - max context) : adding documentation and explainations 055afd8 eldiablo92 commited on Jun 25
feat(vLLM): add quantization param + seperation between modele and KV for inference 7cae9c3 eldiablo92 commited on Jun 25
feat(maxkvcache): improve display of information , add model quantiz option 4f5ced8 eldiablo92 commited on Jun 24
feat(kv-cache): add model weight reduction per quantization level and total d000ed5 eldiablo92 commited on Jun 23
feat: Add option to include model weights in max conctext compute + enhance front + fix when model do not fit + add models d1cb202 eldiablo92 commited on Jun 21
(fix) more details , bugs in convertion based on 1000 or 1024 1431b7a eldiablo92 commited on Sep 25, 2025