arXiv cs.AI / cs.LG / cs.CL·9d agoHarm Laundering in GPT Models: Evidence That Gender Discrimination Is Transformed Rather Than Reduced Across Safety-Trained Generations#alignment#bias#evaluationAI safety & security
Hacker News · security·12d agoUnsolved Problem by Fields Medalist Breached by Two High School Students#ai-assisted-math#arxiv#claude-opus 15 min
Check Point Research·16d agoPuzzleMask: Abusing Plain Prose as a Covert AI Attack Vector#ai-safety#check-point#gpt-5 15 min
Hugging Face daily papers·18d agoMetroLLM-Bench: Evaluating Language Models as Transit Kiosk Runtimes#agents#benchmark#fine-tuning1
The Decoder·18d agoOpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper#ai-assisted-research#anthropic#clay-millennium-problems 4 min1