arXiv cs.AI / cs.LG / cs.CL·2d agoJevOut: Natural Context Can Flip Decision Models#decision-models#jev#robustnessAI safety & security
arXiv cs.AI / cs.LG / cs.CL·4d agoType-Safe Is Not Error-Free: A Constrained Decision Head Follows the Option Name, Not the Rubric Bound to It#structured-output#decision-models#option-namingAI research
arXiv cs.AI / cs.LG / cs.CL·9d agoCross-Modal Attention Acts as a Frequency Filter: Why Verbose Prompts Improve Robustness in Vision-Language Models#cross-modal-attention#image-corruption#llava-onevisionAI research1
arXiv cs.CR·10d agoSoK: Trading Agents or Market Crashers? Dissecting Robustness and Security Failures in Academic Financial LLM Trading Schemes#adversarial-attacks#agent-security#benchmarkAI safety & security1
Hugging Face daily papers·10d agoTraining-Adaptive Convolutional Sparse Coding via Information Bottleneck for Robust Visual Representation#computer-vision#information-bottleneck#representation-learning
arXiv cs.AI / cs.LG / cs.CL·22d agoSame Trajectory, Contradictory Rewards (ROBORMBENCH): Paraphrase Fragility in Vision Language Reward Models#benchmark#paraphrase-invariance#reward-modelsAI research1
Hugging Face daily papers·27d agoPLC-DPO: Posterior Label Correction in Noisy and Ambiguous Preference Optimization#alignment#dpo#noisy-labels