Hacker News · security·18d agoLarge Language Models Develop Novel Social Biases Through Adaptive Exploration#emergent-behavior#fairness#llmAI research1
arXiv cs.AI / cs.LG / cs.CL·18d agoActReview: Rebuttal-Guided Training Data and Rubric Rewards for Actionable Peer Review Generation#benchmark#grpo#llmAI research1
Hugging Face daily papers·19d agoActReview: Rebuttal-Guided Training Data and Rubric Rewards for Actionable Peer Review Generation#benchmark#grpo#llm