arXiv cs.AI / cs.LG / cs.CL·2d agoSAGE: Semantic Anchor-Guided Evolution for Grounded Medical QA Data Synthesis#medical-qa#data-synthesis#sageAI research1
arXiv cs.AI / cs.LG / cs.CL·3d agoConditional Rank Allocation for Taxonomy-Aware Medical Language Model Adaptation#medical-qa#parameter-efficient-finetuning#loraAI research
Hugging Face daily papers·7d agoMetaRubric: Learning to Reward for Rubric-Based Reinforcement Learning#reinforcement-learning#rubric-rewards#grpo