Hugging Face daily papers·3d agoQwenGyre: An Elastic Reinforcement Learning Framework for Training xLong-Horizon Agents#reinforcement-learning#agents#qwengyre