Inference Providers
Active filters: nvidia
nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8
Text Generation
• 124B • Updated • 155k
• 276
65B • Updated • 126k
• 240
nvidia/Nemotron-Cascade-2-30B-A3B
Text Generation
• 32B • Updated • 56.7k
• 524
nvidia/Kimodo-SOMA-RP-v1.1
0.3B • Updated • 3.4k
• 48
nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16
Any-to-Any
• 33B • Updated • 406k
• 420
nvidia/Nemotron-Labs-Diffusion-14B
Text Generation
• 14B • Updated • 6.01k
• 154
unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
Text Generation
• 32B • Updated • 13.6k
• 142
nvidia/Gemma-4-26B-A4B-NVFP4
Text Generation
• 14B • Updated • 1.65M
• 129
unsloth/NVIDIA-Nemotron-3-Ultra-550B-A55B-GGUF
Text Generation
• 549B • Updated • 7.36k
• 37
prometheusAIR/Cosmos3-Super-FP8
Image-to-Video
• Updated • 15
• 2
nvidia/NVIDIA-Nemotron-Labs-Teacher-Chat
Text Generation
• 561B • Updated • 1.35k
• 2
impacte/NVIDIA-Nemotron-3.5-Lightning-GGUF
Text Generation
• 33B • Updated • 3
• 2
nvidia/Mistral-NeMo-12B-Instruct
Updated • 204
• 178
nvidia/Nemotron-Mini-4B-Instruct
Text Generation
• Updated • 8.79k
• 186
nvidia/Llama-3.1-Nemotron-70B-Instruct
Updated • 56
• 569
bartowski/Llama-3.1-Nemotron-70B-Instruct-HF-GGUF
Text Generation
• 71B • Updated • 1.93k
• 108
nvidia/Llama-3.3-Nemotron-70B-Feedback
Text Generation
• 71B • Updated • 155
• • 10
nvidia/Llama-3.3-Nemotron-70B-Edit
Text Generation
• 71B • Updated • 133
• 5
nvidia/Cosmos-Predict2-2B-Text2Image
Text-to-Image
• Updated • 396
• 93
bartowski/nvidia_OpenCodeReasoning-Nemotron-7B-GGUF
Text Generation
• 8B • Updated • 781
• 2
nvidia/AceReason-Nemotron-14B
Text Generation
• 15B • Updated • 590
• • 99
nvidia/Cosmos-Predict2.5-2B
Updated • 10.1k
• 157
NVFP4/Qwen3-30B-A3B-Thinking-2507-FP4
Text Generation
• 16B • Updated • 827
• 5
nvidia/NVIDIA-Nemotron-Nano-9B-v2
Text Generation
• 9B • Updated • 393k
• 514
mlx-community/NVIDIA-Nemotron-Nano-9B-v2-4bits
Text Generation
• 1B • Updated • 763
• 4
Image-Text-to-Text
• 4B • Updated • 1.03k
• 32
Image-to-Image
• Updated • 1.61k
• 26
nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-NVFP4-QAD
Image-Text-to-Text
• 8B • Updated • 10.6k
• 29
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
Text Generation
• 32B • Updated • 961k
• • 813
sainikhiljuluri2015/NVIDIA-Orchestrator-Cybersecurity-8B-Merged
Text Generation
• 8B • Updated • 87
• 3