arXiv AI

The Model's Tell: Measuring Context-Leakage Attack Signals with Behavior Gauges

arXiv:2608. 17829v1 Announce Type: cross Abstract: LLMs increasingly rely on external contexts, such as pre-defined system prompts or retrieved documents, to improve generation quality.