arXiv cs.AI / cs.LG / cs.CL·10d agoDouble descent is the principle of least action#double-descent#generalization#learning-theoryAI research
arXiv cs.AI / cs.LG / cs.CL·15d agoQuantile-based Loss Filtering for Outlier-Robust Stochastic Gradient Descent#convergence#optimization#outlier-robustnessAI research