arXiv cs.CR·5d agoMaking Agents More Consistent: Skills Should Form Habits for Repeat Tasks#llm-agents#consistency#determinismAI research
arXiv cs.CR·9d agoConformal Privacy Auditing: Calibrated Re-identification Attacks with Statistical Guarantees#privacy#re-identification#conformal-predictionResearch
TechCrunch · AI·10d agoAI labs want in-house auditors — but maybe they should shut the front door first#agent-security#ai-agents#anthropic 6 min
arXiv cs.AI / cs.LG / cs.CL·11d agoOPEN-1B: A Fully Auditable Training Run#auditing#floating-point#model-releaseAI research1
Hugging Face daily papers·20d agoScores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research Agents#ai-agents#auditing#evaluation