arXiv AI

ReQuant: Fixed-Grid Discrete Refinement for Post-Training Quantization

arXiv:2608. 07019v1 Announce Type: new Abstract: Post-training quantization (PTQ) is widely used to reduce the memory and computational cost of large language models.