Hugging Face daily papers·4d agoRubric Rewards from Item Response Theory#reinforcement-learning#rubrics#item-response-theory
arXiv cs.CR·4d agoSecProbe: Adaptive Evaluation of Coding Agents on Cybersecurity Vulnerabilities#secprobe#coding-agents#vulnerability-repairAI safety & security