RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-FP8-dynamic Text Generation • 561B • Updated 14 days ago • 3.96k • 1
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-FP8-block Text Generation • 561B • Updated 14 days ago • 12.7k
RedHatAI/NVIDIA-Nemotron-3-Ultra-550B-A55B-quantized.w4a16 Text Generation • 565B • Updated 14 days ago • 1.08k • 3
RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w8a8 Text Generation • 8B • Updated 17 days ago • 27.6k • 20
RedHatAI/Meta-Llama-3.1-8B-Instruct-FP8-dynamic Text Generation • 8B • Updated 17 days ago • 77.2k • 9
RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w4a16 Text Generation • 8B • Updated 17 days ago • 71.5k • 30
RedHatAI/Mistral-Small-3.1-24B-Instruct-2503-FP8-dynamic Image-Text-to-Text • 24B • Updated 27 days ago • 8.89k • 9