Hugging Face trending models·5d agoEdge0/Audio8-ASR-Infinite — new model trending #30 on Hugging Face#asr#speech-recognition#streamingModel release 6 min
arXiv cs.AI / cs.LG / cs.CL·9d agoRetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning#distillation#llm-agents#multi-turn-agentsAI research
Hugging Face daily papers·10d agoRetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning#agentic-rl#alfworld#distillation
Hugging Face trending models·11d agoharshatheg/Qwen-2.5-1B-RLCD — new model trending #30 on Hugging Face#apple-silicon#constrained-decoding#inferenceAI tools & infra 9 min2
arXiv cs.CR·17d agoActive Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning#adversarial-fine-tuning#ai-safety#gemma-3AI safety & security1
Hugging Face daily papers·18d agoTowards a Deterministic Math Solver for Clinical Language Models#clinical-calculators#deterministic-solver#llm-arithmetic1
Hugging Face daily papers·20d agoSQS: Bayesian DNN Compression through Sparse Quantized Sub-distributions#bayesian-learning#llama3.2#model-compression