arXiv cs.AI / cs.LG / cs.CL·9d agoThink Thrice Before Reranking: Multi-perspective Evidence and Reasoning Integration for Text Reranking#benchmarks#information-retrieval#llm-reasoningAI research
arXiv cs.AI / cs.LG / cs.CL·12d agoBellman Policy Optimization#llm-reasoning#math-reasoning#policy-optimizationAI research
Hugging Face daily papers·13d agoBellman Policy Optimization#bellman-equations#llm-reasoning#policy-optimization
The Decoder·14d agoAI models' written reasoning steps correspond to distinct internal patterns, a new study finds#activation-analysis#chain-of-thought#interpretability 4 min2