arXiv cs.AI / cs.LG / cs.CL·11d agoCoupled Calibration and Learning: Mitigating Teacher Bias in LLM Distillation without Target-Domain Reward Feedback#covariate-shift#distillation#knowledge-transferAI research1