arXiv AI

Visible Reasoning and Indirect Prompt-Injection Monitorability Across English, Tamil, and Tanglish

arXiv:2608. 15392v1 Announce Type: new Abstract: Chain-of-thought monitoring is a potentially useful safety signal, but its reliability across languages and behavioral settings remains uncertain.