Inference Providers
Active filters: npu
dahara1/llama3.1-8b-Instruct-amd-npu
Text-to-Speech
• Updated • 186
• 4
piffie/Llama-3.2-3B-Instruct-Genie-Snapdragon-X2-Elite-v81-16k
litert-community/EmbeddingGemma-300M-Tensor-G4-NPU
Feature Extraction
• Updated • 68
• 1
dahara1/llama3-8b-amd-npu
dahara1/ALMA-Ja-V3-amd-npu
dahara1/llama-translate-amd-npu
Translation
• Updated • 5
dahara1/llama-translate-gguf
8B • Updated • 1.3k
• 16
FluidInference/qwen3-0.6b-int4-ov-npu
FluidInference/qwen3-8b-int4-ov-npu
Updated • 33
• 1
FluidInference/qwen3-1.7b-int4-ov-npu
FluidInference/qwen3-4b-int4-ov-npu
Updated • 75
• 1
magicunicorn/kokoro-npu-quantized
Text-to-Speech
• Updated • 3
FluidInference/whisper-tiny-int4-ov-npu
magicunicorn/unicorn-execution-engine-models
Updated
AhtnaGlen/phi-4-mini-instruct-int4-sym-npu-ov
Text Generation
• Updated • 38
rk-transformers/distilbert-base-uncased-finetuned-sst-2-english
Updated • 16
rk-transformers/all-MiniLM-L6-v2
Sentence Similarity
• Updated • 27
rk-transformers/bert-base-uncased
Updated • 12
rk-transformers/ms-marco-MiniLM-L12-v2
Text Ranking
• Updated • 11
rk-transformers/distilbert-base-cased-distilled-squad
rk-transformers/bert-base-NER
rk-transformers/bert-base-uncased_SWAG
NexaAI/rf-detr-seg-preview-npu
Object Detection
• Updated • 16
rk-transformers/ModernBERT-base
crimsonmythos/translategemma-4b-it_w8a8_RK3588
Text Generation
• Updated • 19
• 2
AscendKernelGen/KernelGen-LM-1.7B
Text Generation
• 2B • Updated • 29
• 1
AscendKernelGen/KernelGen-LM-4B
Text Generation
• 4B • Updated • 34
• 1
AscendKernelGen/KernelGen-LM-8B
Text Generation
• 8B • Updated • 32
• 1
AscendKernelGen/KernelGen-LM-14B
Text Generation
• 15B • Updated • 35
• 1