arXiv cs.AI / cs.LG / cs.CL·11d agoLearning-Guided Planning in Large Dynamic Action Spaces: Budgeted Tree Search for One-to-Many Mobile Charging#mobile-charging#planning#puctAI research
Hugging Face daily papers·19d agoDifficulty-Adaptive Tree-Structured Policy Optimization for Expanding Reasoning Coverage in RLVR#llm-training#pass-at-k#reasoning2