arXiv cs.AI / cs.LG / cs.CL·4d agoOptimal Sequential Annotations for Off-Policy Evaluation#off-policy-evaluation#reinforcement-learning#annotationAI research
arXiv cs.AI / cs.LG / cs.CL·10d agoExponential Hardness of Off-Policy Evaluation under History-Dependent Logging#lower-bounds#off-policy-evaluation#pomdpAI research1