← back
arXivDeokjae Lee, Sihun Chu, Hyun Oh SongMon, Aug 31, 2026, 3:39 AM PDT
score 17.0

New method cuts AI model size without hurting accuracy

Original: Q-Strata: Hierarchical Bit Allocation for Mixed-Precision Quantization of Mixture-of-Experts LLMs

Source: arxiv.org

Writing ELI5 summary…