MarkTechPost·12h agoFastino Releases GLiNER2.5-Decide: A 340M Open-Weight Decision Model That Runs on CPU#fastino#gliner#open-weights 2 sources 5 min
Help Net Security·2d agoDocker introduces OCI-based Kits to package agents and their guardrails#docker#ai-agents#sandboxesAI tools & infra 5 min
Help Net Security·2d agoStop watching what AI agents say and start watching what they do#ai-agents#guardrails#prompt-injection 5 min
Malwarebytes Labs·5d agoGemini’s breach of real companies exposes an AI guardrail problem#gemini#google#ai-safetyAI safety & security 6 sources 3 min
arXiv cs.CR·5d ago highDecoding Guardrails: XAI-Guided Perturbation Analysis of Prompt Injection Detection#adversarial#guardrails#jailbreakAI safety & security
arXiv cs.AI / cs.LG / cs.CL·8d agoAvailable Guardrails: Certifying Selective Prediction across ML Systems#selective-prediction#guardrails#certificationAI research
arXiv cs.CR·8d agoCASCADE Against Jailbreaks: Combination Across Stages with Controlled Attack-Defense Evaluation#jailbreak#llm-security#defense-in-depthAI safety & security
CSO Online·9d ago16 governance tools for securing your AI fleet#ai-governance#aiops#compliance 12 min1
Infosecurity Magazine·9d agoAI Agent Carries Out Multi-Stage Data Theft Attack#aepd#agentic-ai#ai-agent in the wild 2 min
arXiv cs.CR·10d agoSafety Beyond the Interface: Detecting Harm via Latent States in Large Language Models#guardrails#harm-detection#llama-3.1AI safety & security1
arXiv cs.CR·12d agoToward Secure AI-Powered Penetration Testing Agents: Security Threats, Guardrails, and Architectural Perspectives#agent-security#ai-safety#guardrailsAI safety & security
MarkTechPost·12d agoAgent-net Open Sources Webagent: A Go Harness That Turns Any Website into a Guarded AI Agent#agent-net#ai-agents#go 3 min1
SecurityWeek·12d agoCISOs Race to Control AI Agents Without Destroying Their Value#agent-security#ai-agents#ciso-survey 4 min
Simon Willison·15d agoQuoting Boris Cherny#ai-assisted-programming#claude#claude-codeAI tools & infra2
Security Affairs·16d agoMore Capable AI, Not Enough Guardrails#agent-security#ai-agents#ai-safety 7 min
arXiv cs.CR·18d agoCS-Guard: Benchmarking LLM Guardrails for Code Generation Security#benchmark#code-generation#cs-guardAI safety & security1
TechCrunch · Security·23d agoAbliteration.ai is making a business out of removing AI guardrails#abliteration#ai-safety#glm-5.3 6 min
Dark Reading·26d agoThe Guardrails Debate: Security Researcher Changes His Mind#ai-security#defenders#guardrails
Ars Technica · Security·Aug 20, 2026Grok exfiltrates user data when malicious instructions are encrypted#ai-safety#cryptographic-context-injection#data-exfiltration1
Help Net Security·Aug 19, 2026F5 enhances AI Gateway to control AI costs, access, and security#ai-gateway#ai-security#f5AI tools & infra 4 min