Text Generation
NeMo
ONNX
Safetensors
GGUF
English
Persian
local-llm
quantized
rtx-3060
consumer-hardware
code
agent
agents
rag
embeddings
reranker
text-to-speech
speech-to-text
multimodal
vision
voice-cloning
persian
farsi
uncensored
abliterated
imatrix
conversational
Instructions to use m15dg/local-ai-toolkit with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- NeMo
How to use m15dg/local-ai-toolkit with NeMo:
# tag did not correspond to a valid NeMo domain.
- Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- llama.cpp
How to use m15dg/local-ai-toolkit with llama.cpp:
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh # Start a local OpenAI-compatible server with a web UI: llama serve -hf m15dg/local-ai-toolkit:UD-Q4_K_XL # Run inference directly in the terminal: llama cli -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Install from WinGet (Windows)
winget install llama.cpp # Start a local OpenAI-compatible server with a web UI: llama serve -hf m15dg/local-ai-toolkit:UD-Q4_K_XL # Run inference directly in the terminal: llama cli -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Use pre-built binary
# Download pre-built binary from: # https://github.com/ggerganov/llama.cpp/releases # Start a local OpenAI-compatible server with a web UI: ./llama-server -hf m15dg/local-ai-toolkit:UD-Q4_K_XL # Run inference directly in the terminal: ./llama-cli -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git cd llama.cpp cmake -B build cmake --build build -j --target llama-server llama-cli # Start a local OpenAI-compatible server with a web UI: ./build/bin/llama-server -hf m15dg/local-ai-toolkit:UD-Q4_K_XL # Run inference directly in the terminal: ./build/bin/llama-cli -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Use Docker
docker model run hf.co/m15dg/local-ai-toolkit:UD-Q4_K_XL
- LM Studio
- Jan
- vLLM
How to use m15dg/local-ai-toolkit with vLLM:
Install from pip and serve model
# Install vLLM from pip: pip install vllm # Start the vLLM server: vllm serve "m15dg/local-ai-toolkit" # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:8000/v1/chat/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "m15dg/local-ai-toolkit", "messages": [ { "role": "user", "content": "What is the capital of France?" } ] }'Use Docker
docker model run hf.co/m15dg/local-ai-toolkit:UD-Q4_K_XL
- Ollama
How to use m15dg/local-ai-toolkit with Ollama:
ollama run hf.co/m15dg/local-ai-toolkit:UD-Q4_K_XL
- Unsloth Studio
How to use m15dg/local-ai-toolkit with Unsloth Studio:
Install Unsloth Studio (macOS, Linux, WSL)
curl -fsSL https://unsloth.ai/install.sh | sh # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for m15dg/local-ai-toolkit to start chatting
Install Unsloth Studio (Windows)
irm https://unsloth.ai/install.ps1 | iex # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for m15dg/local-ai-toolkit to start chatting
Using HuggingFace Spaces for Unsloth
# No setup required # Open https://huggingface.co/spaces/unsloth/studio in your browser # Search for m15dg/local-ai-toolkit to start chatting
- Pi
How to use m15dg/local-ai-toolkit with Pi:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Configure the model in Pi
# Install Pi: npm install -g @mariozechner/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "llama-cpp": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "m15dg/local-ai-toolkit:UD-Q4_K_XL" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Hermes Agent new
How to use m15dg/local-ai-toolkit with Hermes Agent:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default m15dg/local-ai-toolkit:UD-Q4_K_XL
Run Hermes
hermes
- Atomic Chat new
- OpenClaw new
How to use m15dg/local-ai-toolkit with OpenClaw:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf m15dg/local-ai-toolkit:UD-Q4_K_XL
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "m15dg/local-ai-toolkit:UD-Q4_K_XL" \ --custom-provider-id llama-cpp \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
- Docker Model Runner
How to use m15dg/local-ai-toolkit with Docker Model Runner:
docker model run hf.co/m15dg/local-ai-toolkit:UD-Q4_K_XL
- Lemonade
How to use m15dg/local-ai-toolkit with Lemonade:
Pull the model
# Download Lemonade from https://lemonade-server.ai/ lemonade pull m15dg/local-ai-toolkit:UD-Q4_K_XL
Run and chat with the model
lemonade run user.local-ai-toolkit-UD-Q4_K_XL
List all available models
lemonade list
| *.7z filter=lfs diff=lfs merge=lfs -text | |
| *.arrow filter=lfs diff=lfs merge=lfs -text | |
| *.bin filter=lfs diff=lfs merge=lfs -text | |
| *.bz2 filter=lfs diff=lfs merge=lfs -text | |
| *.ckpt filter=lfs diff=lfs merge=lfs -text | |
| *.ftz filter=lfs diff=lfs merge=lfs -text | |
| *.gz filter=lfs diff=lfs merge=lfs -text | |
| *.h5 filter=lfs diff=lfs merge=lfs -text | |
| *.joblib filter=lfs diff=lfs merge=lfs -text | |
| *.lfs.* filter=lfs diff=lfs merge=lfs -text | |
| *.mlmodel filter=lfs diff=lfs merge=lfs -text | |
| *.model filter=lfs diff=lfs merge=lfs -text | |
| *.msgpack filter=lfs diff=lfs merge=lfs -text | |
| *.npy filter=lfs diff=lfs merge=lfs -text | |
| *.npz filter=lfs diff=lfs merge=lfs -text | |
| *.onnx filter=lfs diff=lfs merge=lfs -text | |
| *.ot filter=lfs diff=lfs merge=lfs -text | |
| *.parquet filter=lfs diff=lfs merge=lfs -text | |
| *.pb filter=lfs diff=lfs merge=lfs -text | |
| *.pickle filter=lfs diff=lfs merge=lfs -text | |
| *.pkl filter=lfs diff=lfs merge=lfs -text | |
| *.pt filter=lfs diff=lfs merge=lfs -text | |
| *.pth filter=lfs diff=lfs merge=lfs -text | |
| *.rar filter=lfs diff=lfs merge=lfs -text | |
| *.safetensors filter=lfs diff=lfs merge=lfs -text | |
| saved_model/**/* filter=lfs diff=lfs merge=lfs -text | |
| *.tar.* filter=lfs diff=lfs merge=lfs -text | |
| *.tar filter=lfs diff=lfs merge=lfs -text | |
| *.tflite filter=lfs diff=lfs merge=lfs -text | |
| *.tgz filter=lfs diff=lfs merge=lfs -text | |
| *.wasm filter=lfs diff=lfs merge=lfs -text | |
| *.xz filter=lfs diff=lfs merge=lfs -text | |
| *.zip filter=lfs diff=lfs merge=lfs -text | |
| *.zst filter=lfs diff=lfs merge=lfs -text | |
| *tfevents* filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Quality/Qwen3.6-35B-A3B-UD-Q4_K_XL/content/temp_downloads/Qwen3.6-35B-A3B-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Speed/Qwen3.5-9B-Q5_K_M/content/temp_downloads/Qwen3.5-9B-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/1-Architect_and_Executor/Qwen3-Coder-30B-A3B-Instruct-Q5_K_M/Qwen3-Coder-30B-A3B-Instruct-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/2-Detective_and_Debugger/DeepSeek-R1-Distill-Qwen-32B-Q4_K_M/DeepSeek-R1-Distill-Qwen-32B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/3-Inline_Autocomplete/qwen2.5-coder-7b-instruct-q5_k_m/qwen2.5-coder-7b-instruct-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/4-Architect_and_Executor_speed/Qwen2.5_Coder_14B_Instruct_Q4_K_M/content/raw_Qwen2.5_Coder_14B_Instruct_Q4_K_M/Qwen2.5_Coder_14B_Instruct_Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/5-Detective_and_Debugger_speed/DeepSeek_R1_Distill_Qwen_14B_Q4_K_M/content/raw_DeepSeek_R1_Distill_Qwen_14B_Q4_K_M/DeepSeek_R1_Distill_Qwen_14B_Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-agent/GLM-4.7-Flash-UD-Q4_K_XL/content/pipeline_raw/GLM-4.7-Flash-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/gemma-4-12b-it-UD-Q4_K_XL/content/pipeline_raw/gemma-4-12b-it-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/mmproj-F16/content/pipeline_raw/mmproj-F16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/mtp-gemma-4-12b-it/content/pipeline_raw/mtp-gemma-4-12b-it.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/1-Embeddings/BGE_M3_Core_Embedding/content/raw_BGE_M3_Core_Embedding/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/2-Rerankers/BGE_Reranker_V2_M3_Core/content/raw_BGE_Reranker_V2_M3_Core/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/3-GraphRAG_Extractors/NuExtract_1_5_GraphRAG_Extractor/content/raw_NuExtract_1_5_GraphRAG_Extractor/NuExtract-v1.5-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/4-Web_Distillers/Jina_Reader_LM_1_5B_Web_Distiller/content/raw_Jina_Reader_LM_1_5B_Web_Distiller/reader-lm-1.5b-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 6-STT/Quality/Persian_ASR/Anti_Hallucination_FastConformer_Fa/content/raw_Anti_Hallucination_FastConformer_Fa/stt_fa_fastconformer_hybrid_large.nemo filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Quality/Qwen3_Omni_30B_A3B_Quality/content/raw_Qwen3_Omni_30B_A3B_Quality/Qwen3-Omni-30B-A3B-Instruct-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Quality/Qwen3_Omni_30B_A3B_Quality/content/raw_Qwen3_Omni_30B_A3B_Quality/mmproj-Qwen3-Omni-30B-A3B-Instruct-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/content/raw_Gemma4_E4B_Speed_Speculative/MTP/gemma-4-E4B-it-F16-MTP.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/content/raw_Gemma4_E4B_Speed_Speculative/gemma-4-E4B-it-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/content/raw_Gemma4_E4B_Speed_Speculative/mmproj-F16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Quality/Hermes_4_3_36B_Quality_Orchestrator/content/raw_Hermes_4_3_36B_Quality_Orchestrator/hermes-4_3_36b-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Speed/Hermes_4_14B_Speed_Guardrail/content/raw_Hermes_4_14B_Speed_Guardrail/Hermes-4-14B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Guardrails/Llama_Guard_3_8B_i1_Firewall/content/raw_Llama_Guard_3_8B_i1_Firewall/Llama-Guard-3-8B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Autonomous_Research/Agents_A1_35B_MoE_Calibrated_CEO/content/raw_Agents_A1_35B_MoE_Calibrated_CEO/Agents-A1-IQ4_XS-imatrix-gguf-fable5-calibrated.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Agentic_Workers/Gemma4_12B_Agentic_Worker_v2/content/raw_Gemma4_12B_Agentic_Worker_v2/Gemma4_12B_Agentic_Worker_v2.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Speed/General/Huihui_Qwen3_VL_8B_Uncensored_Q8_0/content/raw_Huihui_Qwen3_VL_8B_Uncensored_Q8_0/Huihui-Qwen3-VL-8B-Instruct-abliterated.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Speed/Code/Huihui_Qwen3_Coder_30B_Uncensored_i1_Q3_K_M/content/raw_Huihui_Qwen3_Coder_30B_Uncensored_i1_Q3_K_M/Huihui-Qwen3-Coder-30B-A3B-Instruct-abliterated.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Quality/General/Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/content/raw_Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/Huihui-Qwen3.6-35B-A3B-Claude-4.7-Opus-abliterated-ggml-model-Q4_K.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Quality/Code/Huihui_Qwen3_VL_30B_Uncensored_Q4_K_M/content/raw_Huihui_Qwen3_VL_30B_Uncensored_Q4_K_M/Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Quality/Qwen3.6-35B-A3B-UD-Q4_K_XL/Qwen3.6-35B-A3B-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Speed/Qwen3.5-9B-Q5_K_M/Qwen3.5-9B-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/4-Architect_and_Executor_speed/Qwen2.5_Coder_14B_Instruct_Q4_K_M/Qwen2.5_Coder_14B_Instruct_Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 2-Coding_Agents/5-Detective_and_Debugger_speed/DeepSeek_R1_Distill_Qwen_14B_Q4_K_M/DeepSeek_R1_Distill_Qwen_14B_Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-agent/GLM-4.7-Flash-UD-Q4_K_XL/GLM-4.7-Flash-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/1-Embeddings/BGE_M3_Core_Embedding/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/2-Rerankers/BGE_Reranker_V2_M3_Core/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/3-GraphRAG_Extractors/NuExtract_1_5_GraphRAG_Extractor/NuExtract-v1.5-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/4-Web_Distillers/Jina_Reader_LM_1_5B_Web_Distiller/reader-lm-1.5b-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/gemma-4-12b-it-UD-Q4_K_XL/gemma-4-12b-it-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/mmproj-F16/mmproj-F16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/mtp-gemma-4-12b-it/mtp-gemma-4-12b-it.gguf filter=lfs diff=lfs merge=lfs -text | |
| 6-STT/Quality/Persian_ASR/Anti_Hallucination_FastConformer_Fa/stt_fa_fastconformer_hybrid_large.nemo filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Quality/Qwen3_Omni_30B_A3B_Quality/Qwen3-Omni-30B-A3B-Instruct-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Quality/Qwen3_Omni_30B_A3B_Quality/mmproj-Qwen3-Omni-30B-A3B-Instruct-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/MTP/gemma-4-E4B-it-F16-MTP.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/gemma-4-E4B-it-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 7-Multimodal/Speed/Gemma4_E4B_Speed_Speculative/mmproj-F16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Agentic_Workers/Gemma4_12B_Agentic_Worker_v2/Gemma4_12B_Agentic_Worker_v2.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Autonomous_Research/Agents_A1_35B_MoE_Calibrated_CEO/Agents-A1-IQ4_XS-imatrix-gguf-fable5-calibrated.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Guardrails/Llama_Guard_3_8B_i1_Firewall/Llama-Guard-3-8B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Quality/Hermes_4_3_36B_Quality_Orchestrator/hermes-4_3_36b-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Agent_Orchestration/Speed/Hermes_4_14B_Speed_Guardrail/Hermes-4-14B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Quality/Code/Huihui_Qwen3_VL_30B_Uncensored_Q4_K_M/Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Quality/General/Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/Huihui-Qwen3.6-35B-A3B-Claude-4.7-Opus-abliterated-ggml-model-Q4_K.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Speed/Code/Huihui_Qwen3_Coder_30B_Uncensored_i1_Q3_K_M/Huihui-Qwen3-Coder-30B-A3B-Instruct-abliterated.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Speed/General/Huihui_Qwen3_VL_8B_Uncensored_Q8_0/Huihui-Qwen3-VL-8B-Instruct-abliterated.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Quality/Qwen3.6-35B-A3B-UD-Q4_K_XL/mmproj-BF16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 1-Universal_Foundation_LLMs/Speed/Qwen3.5-9B-Q5_K_M/mmproj-BF16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/gemma-4-12b-it-UD-Q4_K_XL/mmproj-BF16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/gemma-4-12b-it-UD-Q4_K_XL/MTP/mtp-gemma-4-12b-it-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Quality/General/Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/mmproj-model-f16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 9-Uncensored_Models/Speed/General/Huihui_Qwen3_VL_8B_Uncensored_Q8_0/Huihui-Qwen3-VL-8B-Instruct-abliterated.mmproj-f16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/1-Orchestrators_and_Managers/GLM-4.7-Flash-UD-Q4_K_XL/GLM-4.7-Flash-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/5-LLM_Generators/gemma-4-12b-it-UD-Q4_K_XL/MTP/mtp-gemma-4-12b-it-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/5-LLM_Generators/gemma-4-12b-it-UD-Q4_K_XL/gemma-4-12b-it-UD-Q4_K_XL.gguf filter=lfs diff=lfs merge=lfs -text | |
| 4-Document_Analysis_and_RAG/5-LLM_Generators/gemma-4-12b-it-UD-Q4_K_XL/mmproj-BF16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/2-Agentic_Workers/Gemma4_12B_Agentic_Worker_v2/Gemma4_12B_Agentic_Worker_v2.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/1-Orchestrators_and_Managers/Agents_A1_35B_MoE_Calibrated_CEO/Agents-A1-IQ4_XS-imatrix-gguf-fable5-calibrated.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/3-Guardrails_and_Safety/Llama_Guard_3_8B_i1_Firewall/Llama-Guard-3-8B.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/1-Orchestrators_and_Managers/Hermes_4_3_36B_Quality_Orchestrator/hermes-4_3_36b-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 3-Agent_Orchestration_and_Routing/3-Guardrails_and_Safety/Hermes_4_14B_Speed_Guardrail/Hermes-4-14B-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Quality/Code/Huihui_Qwen3_VL_30B_Uncensored_Q4_K_M/Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Quality/General/Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/Huihui-Qwen3.6-35B-A3B-Claude-4.7-Opus-abliterated-ggml-model-Q4_K.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Quality/General/Huihui_Qwen3.6_35B_Claude4.7_Opus_MTP_Uncensored_Q4_K/mmproj-model-f16.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Speed/Code/Huihui_Qwen3_Coder_30B_Uncensored_i1_Q3_K_M/Huihui-Qwen3-Coder-30B-A3B-Instruct-abliterated.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Speed/General/Huihui_Qwen3_VL_8B_Uncensored_Q8_0/Huihui-Qwen3-VL-8B-Instruct-abliterated.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text | |
| 8-Uncensored_Models/Speed/General/Huihui_Qwen3_VL_8B_Uncensored_Q8_0/Huihui-Qwen3-VL-8B-Instruct-abliterated.mmproj-f16.gguf filter=lfs diff=lfs merge=lfs -text | |