LLMICML2026AlgoOSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization用离群值自吸收实现精确的低比特大模型量化。
VLMICLR2026AlgoTask-related Token Compression in Multi-modal Large Language Models from an Explainability Perspective从可解释性视角出发做任务相关的多模态 Token 压缩。
VLMAlgoTowards Joint Quantization and Token Pruning of Vision-Language Models将量化与视觉 Token 剪枝联合起来做的探索。
VLMAlgoQAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models量化感知的视觉 Token 剪枝。