arXiv cs.AI / cs.LG / cs.CL·8d agoPredictable Failure in Multi-Hop Retrieval: Score-Distributional Confidence Scoring and Abstention#retrieval#multi-hop#ragAI research
arXiv cs.AI / cs.LG / cs.CL·8d agoAvailable Guardrails: Certifying Selective Prediction across ML Systems#selective-prediction#guardrails#certificationAI research
arXiv cs.AI / cs.LG / cs.CL·8d agoAn Interpretable Memory Decision Controller for LLM Agents Based on Three-Signal Complementarity: Decoupling Confidence and Consistency#llm-agents#rag#hallucinationAI safety & security
arXiv cs.AI / cs.LG / cs.CL·8d agoAbstention and Noise Filtering: Two Missing Primitives of Softmax Attention#attention#softmax#gatingAI research
arXiv cs.AI / cs.LG / cs.CL·11d agoWhen Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control#abstention#calibration#hallucinationAI research1
Hugging Face daily papers·17d agoCompetence-Gated Pooling of Language Models and Priors for Event Forecasting#abstention#brier-score#calibration1
Hugging Face daily papers·29d agoRecognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions#abstention#alignment#interpretability