arXiv cs.AI / cs.LG / cs.CL·10d agoA Zeroth-Order Paradigm for LLM Preference Alignment#compo#likelihood-displacement#llmAI research
Hugging Face daily papers·11d agoA Zeroth-Order Paradigm for LLM Preference Alignment#likelihood-displacement#post-training#preference-alignment1