Inference Providers
Active filters: modelopt
DevQuasar/DeepSeek-R1-Distill-Llama-8B_nvfp4
Text Generation
• 5B • Updated • 8
DevQuasar/Qwen.Qwen3-4B-Thinking-2507_nvfp4
Text Generation
• 2B • Updated • 6
nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-NVFP4-QAD
Image-Text-to-Text
• 8B • Updated • 199k
• 28
177B • Updated • 111
• 6
JeiganS/ML2-123B-Magnum-Diamond_fp8
Text Generation
• 123B • Updated • 181
guerilla7/Foundation-Sec-8B-Instruct-NVFP4-quantized
5B • Updated jiangchengchengNLP/L3.3-MS-Nevoria-70b-NVFP4-ONLY-MLP
42B • Updated • 5
jiangchengchengNLP/L3.3-MS-Nevoria-70b-NVFP4_A8
36B • Updated • 5
johnnyeric/Huihui-Qwen3-30B-A3B-Instruct-2507-abliterated-fp4
16B • Updated • 5
jiangchengchengNLP/L3.3-MS-Nevoria-70b-NVFP4_AWQ
36B • Updated • 4
Ex0bit/Qwen3-VLTO-32B-Instruct-NVFP4
Text Generation
• 17B • Updated • 212
• 1
mdavidson83/Qwen3-Embedding-4B_nvfp4_hf
2B • Updated • 193
Ex0bit/Qwen3-VLTO-32B-Instruct-NVFP4-256K
Text Generation
• 17B • Updated • 75
• 1
Image-Text-to-Text
• 13B • Updated • 7
lukealonso/MiniMax-M2-NVFP4
115B • Updated • 7
• 14
Text Generation
• 7B • Updated • 7
• 1
leatan95/Tongyi-DeepResearch-30B-A3B-NVFP4
16B • Updated • 11
DataSnake/Wayfarer-12B-NVFP4
Text Generation
• 7B • Updated • 3
• 1
DataSnake/Wayfarer-2-12B-NVFP4
Text Generation
• 7B • Updated • 7
• 2
Ex0bit/OLMo-3-7B-Instruct-NVFP4-1M
Text Generation
• 4B • Updated • 12
• 2
wangqia0309/Captain-Eris_Violet-V0.420-12B-FP8-KV-modelopt
12B • Updated • 6
rahtml/Qwen3-Coder-30B-A3B-Instruct-NVFP4
16B • Updated • 3
zhuyksir/qwen3_30b_a3b_nvfp4_baseline
16B • Updated • 5
zhuyksir/qwen3_30b_a3b_nvfp4_qat
16B • Updated • 5
alphatozeta/sglang_glm_4_6_fp4_modelopt
177B • Updated • 8
ericlewis/Nemotron-Orchestrator-8B-NVFP4
Text Generation
• 5B • Updated • 13
trithemius/Velvet-14B-nvfp4
8B • Updated • 5
nvidia/Qwen3-Next-80B-A3B-Thinking-NVFP4
Text Generation
• Updated • 1.81k
• 64
OPENZEKA/Qwen3-4B-Instruct-2507-NVFP4
2B • Updated • 342
Z841973620/Qwen3-30B-A3B-NVFP4
Text Generation
• 16B • Updated • 21