arXiv Machine Learning

Priors Persist Through Suppression: A Stroop Paradigm for Lexical Override

arXiv:2606. 07555v1 Announce Type: cross Abstract: Glossaries, technical specifications, and system prompts routinely ask language models to use familiar words in unfamiliar ways.