AAAI2024AlgoOWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models
NeurIPS2022AlgoZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers