arXiv cs.CR·3d agoEvaluating System One Models for Agent Security Decisions: Reliability, Calibration, and Selective Automation#prompt-injection#agent-security#model-judgesAI safety & security