arXiv cs.CR·17d agoBenchShield: Formal Model-Backed Instrumentation for Reward Integrity in LLM-Agent Evaluation Infrastructure#benchmark-integrity#evaluation-infrastructure#llm-agentsAI safety & security1