amd/Llama-3.1-8B-Instruct-w4a16-llmcompressor-v0.10.0.2 Text Generation • 2B • Updated 2 days ago • 263
zentorch TorchAO Quantized Models - PyTorch 2.11 Collection TorchAO v0.17.0 quantized models for AMD EPYC CPU inference. • 27 items • Updated 2 days ago
amd/Llama-3.3-70B-Instruct-da8w8-torchao-v0.17.0 Text Generation • 71B • Updated about 1 month ago • 14
amd/Phi-4-reasoning-plus-da8w8-torchao-v0.17.0 Text Generation • 15B • Updated about 1 month ago • 183
zentorch TorchAO Quantized Models - PyTorch 2.11 Collection TorchAO v0.17.0 quantized models for AMD EPYC CPU inference. • 27 items • Updated 2 days ago