Inference Providers
Active filters: npu
coffeecat77/facefusion-mobile-models
Text-to-Speech
• Updated • 66
• 4
Atomic-Germ/Gemma4-E4B-GLM-FLASH-NPU2
Text Generation
• Updated • 351
• 1
Buuta/sd-3.5-medium-turbo-for-Snapdragon-X-Elite
Text-to-Image
• Updated • 2
DALabCommunity/Haidass-143M-v1
Text Generation
• 0.1B • Updated • 396
• 12
phantomic12/maple-preview-20b-q4nx
20B • Updated • 657
• 1
f3nc3r/Ornith-1.0-9B-NPU2
Image-Text-to-Text
• Updated • 40
• 1
Text-to-Image
• Updated • 1
Buuta/flan-t5-xxl-for-Snapdragon-X-Series
Updated • 1
litert-community/EmbeddingGemma-300M-Tensor-G4-NPU
Feature Extraction
• Updated • 21
• 1
litert-community/Gemma3-1B-IT-Tensor-G4-NPU
Text Generation
• Updated • 15
• 1
dahara1/llama3-8b-amd-npu
dahara1/llama3.1-8b-Instruct-amd-npu
dahara1/ALMA-Ja-V3-amd-npu
dahara1/llama-translate-amd-npu
Translation
• Updated • 5
dahara1/llama-translate-gguf
8B • Updated • 1.24k
• 16
FluidInference/qwen3-0.6b-int4-ov-npu
FluidInference/qwen3-8b-int4-ov-npu
Updated • 33
• 1
FluidInference/qwen3-1.7b-int4-ov-npu
FluidInference/qwen3-4b-int4-ov-npu
Updated • 75
• 1
magicunicorn/kokoro-npu-quantized
Text-to-Speech
• Updated • 3
FluidInference/whisper-tiny-int4-ov-npu
magicunicorn/unicorn-execution-engine-models
Updated
AhtnaGlen/phi-4-mini-instruct-int4-sym-npu-ov
Text Generation
• Updated • 32
rk-transformers/distilbert-base-uncased-finetuned-sst-2-english
Updated • 20
rk-transformers/all-MiniLM-L6-v2
Sentence Similarity
• Updated • 32
rk-transformers/bert-base-uncased
Updated • 16
rk-transformers/ms-marco-MiniLM-L12-v2
Text Ranking
• Updated • 7
rk-transformers/distilbert-base-cased-distilled-squad
rk-transformers/bert-base-NER