Authors
Loading...
This work introduces DeltaMix for minimizing quantization error in delta compression of LLMs, suggesting improvements in mixed-precision techniques.
Xiong et al. (2025) studied this question.