Loading the SOTA2 catalog…
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices · SOTA2 Research