HIGGS - a inference-optimization Collection

inference-optimization 's Collections

HIGGS-per-tensor

Granite 4 Small and Tiny Quantized Models

NVIDIA-Nemotron-3-Nano-30B-A3B Quantized Models

Qwen3-Next-80B-A3B Quantized Models

HIGGS

updated 13 days ago

Mixed Precision Models