arXiv cs.CR·2d agoJust Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures#alignment#evals#benchmarkAI safety & security 2 sources
arXiv cs.AI / cs.LG / cs.CL·5d agoOSWorld-Pro: Process-based Evaluation for Computer Use Agents#osworld#osworld-pro#computer-use-agentsAI research
arXiv cs.CR·6d agoForgeable Confirmation in Automated Computer Security Testing: Deterministic Rules versus AI Judges#ai-agents#security-testing#llm-judgeAI safety & security
arXiv cs.AI / cs.LG / cs.CL·9d agoMulti-Dimensional Prosody Judgment For Live Streaming Speech Synthesis#distillation#grpo#llm-judgeAI research1
Hugging Face daily papers·10d agoWhen AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation#evaluation#llm#llm-judge