arXiv cs.AI / cs.LG / cs.CL·19d agoLLM Forensics: Where Do Backdoors Hide? Localizing and Controlling Trigger Mechanisms with Sparse Autoencoders#ai-security#language-models#llm-backdoorsAI safety & security1