arXiv AI

The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

arXiv:2607. 08734v1 Announce Type: new Abstract: Post-training quantization is widely used to deploy large language models in resource-constrained settings, yet its evaluation relies almost exclusively on accuracy and perplexity.