arXiv cs.AI / cs.LG / cs.CL·8d agoMultiplicative Optimism for Constant Regret in Games#regret-matching#game-theory#online-learningAI research
arXiv cs.AI / cs.LG / cs.CL·9d agoMinimax-Optimal Online Contract Design with Unrestricted Bounded Contracts#contract-design#mechanism-design#minimaxAI research
Hugging Face daily papers·22d agoOnline Learning with LLM Experts from Limited Feedback#bandits#llm#llm-routing