arXiv cs.CR·2d agoENDOPROMPT: Victim-Side Pseudo-References for Utility Degradation#prompt-injection#endoprompt#llm-securityAI safety & security
arXiv cs.CR·2d agoPrefilling the Reasoning Channel: Output-Prefix Attacks on Reasoning LLMs#prompt-injection#jailbreak#reasoning-modelsAI safety & security
arXiv cs.CR·4d agoFrom Alignment to Access Control: A Framework for GenAI Policy Enforcement#genai#policy-enforcement#access-controlAI safety & security
arXiv cs.CR·8d agoCASCADE Against Jailbreaks: Combination Across Stages with Controlled Attack-Defense Evaluation#jailbreak#llm-security#defense-in-depthAI safety & security
Hugging Face daily papers·9d agoAPort Vault: Benchmarking AI Agent Payment Authorization with the Open Agent Passport#agent-security#ai-safety#benchmark
arXiv cs.CR·9d agoInference-Engine Fingerprinting Attacks are Practical: Exploring Model-Driven Environmental Discovery, Exploitation, and Escape#agentic-ai#fingerprinting#inference-engineAI safety & security
CSO Online·9d ago16 governance tools for securing your AI fleet#ai-governance#aiops#compliance 12 min1
arXiv cs.CR·10d agoCharacterizing Network Centralization and Observability in the Remote MCP Ecosystem#agents#ecosystem-measurement#llm-securityAI safety & security1
arXiv cs.CR·11d agoInceptionRAG: Stealthy Poisoning Attack Against Retrieval-Augmented Generation#adversarial-ml#corpus-poisoning#indirect-prompt-injectionResearch1
arXiv cs.CR·12d agoMarkSec: Capability-Aware Evaluation of Adversarial Attacks Against LLM Watermarks#adversarial-attacks#evaluation-framework#llm-securityResearch
arXiv cs.CR·12d agoCiteShade: Citation Laundering in Multi-Source Retrieval-Augmented Generation and Its Counterfactual Defense#adversarial-attack#citation-laundering#llm-securityAI safety & security1
arXiv cs.CR·12d agoApproval Integrity and Recovery in LLM Answer Publication#authorization#evals#llm-securityAI safety & security
arXiv cs.CR·13d agoPIDS-Bench: Evaluating Prompt-Injection Detectors Under Over-Defense, Obfuscation, and Distribution Shift#benchmark#detectors#evaluationAI safety & security
Hugging Face daily papers·13d agoPick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks#backdoor-attacks#data-poisoning#finetuning1
arXiv cs.CR·17d agoToxicRAG: Compromising Retrieval-Augmented Generation Systems via Single-Shot Knowledge Poisoning Attacks#data-poisoning#knowledge-poisoning#llm-securityAI safety & security1
arXiv cs.CR·17d agoActive Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning#adversarial-fine-tuning#ai-safety#gemma-3AI safety & security1
arXiv cs.CR·17d agoUnderstanding the Security Boundary of Obfuscation-based On-Device LLM Protection#adversarial-attack#ip-protection#llm-securityAI safety & security
CSO Online·17d agoWhen the prompt becomes the payload: A practical pen-testing guide for GenAI, LLM and RAG applications#agentic-ai#llm-security#nist 9 min1
arXiv cs.CR·19d agoACEA: An Adversarial Co-Evolution Arena for Head-to-Head Red-Team and Blue-Team LLM Testing#asap#benchmarking#blue-teamAI safety & security1
arXiv cs.CR·23d agoRethinking Indirect Prompt Injection as a Test-Time Search Problem#adversarial-attacks#agentic-ai#ai-evalsAI safety & security
Akamai Blog·Aug 14, 2026The OWASP Top 10 for LLM Applications 2026: From Model Risks to Agentic Security#agentic-ai#application-security#llm-securityAI safety & security