Help Net Security·2d agoCloud Range lets SOCs benchmark AI agents against human defenders#cloud-range#ai-agents#socTools 3 min
OpenAI News·5d agoPriorities and principles for effective third party assessments#openai#ai-safety#third-party-assessment 11 min
NVIDIA Blog·5d agoAI Security Is an Engineering Problem — How to Solve It at Every Layer of the Agent Stack#nvidia#openshell#agent-security 5 min
TechCrunch · AI·8d agoAnthropic’s first embedded evaluator is … Accenture?#accenture#ai-safety#alignment 2 min
arXiv cs.CR·8d agoCASCADE Against Jailbreaks: Combination Across Stages with Controlled Attack-Defense Evaluation#jailbreak#llm-security#defense-in-depthAI safety & security
Ars Technica · Security·9d agoLLMs respond differently to harmful prompts when AI watermarking is used#google#hugging-face#llm-safety 4 min3
CSO Online·9d ago16 governance tools for securing your AI fleet#ai-governance#aiops#compliance 12 min1
Help Net Security·10d agoTuskira Vector brings autonomous red teaming to attack surface validation#agentic-ai#attack-surface-validation#digital-twinTools 3 min
arXiv cs.CR·10d agoRed-Teaming Auto Mode: Improving Blocking Classifiers Against Malign Coding Agents#agent-security#ai-safety#claude-codeAI safety & security1
SecurityWeek·10d agoVirtual Event Today: Attack Surface Management Summit#aibom#attack-surface-management#event 2 min
Help Net Security·10d agoOne runaway AI agent racked up a $50,000 cloud bill#ai-agents#ai-supply-chain#gtig in the wild 4 min3
Help Net Security·11d agoMicrosoft sets security and safety rules for its AI models#ai-safety#alignment#code-of-conduct 4 min
arXiv cs.CR·13d agoPick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks#backdoor#data-poisoning#fine-tuningAI safety & security1
Hugging Face daily papers·13d agoPick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks#backdoor-attacks#data-poisoning#finetuning1
CSO Online·15d ago highAnthropic finds evidence of a fourth AI escaping from containment#ai-safety#anthropic#claude1
arXiv cs.CR·19d agoStructural Jailbreaks Generalize but Do Not Compound: A cross-provider and multilingual study of Involuntary In-Context Learning#benchmark#gemini#iiclAI safety & security1
arXiv cs.CR·19d agoACEA: An Adversarial Co-Evolution Arena for Head-to-Head Red-Team and Blue-Team LLM Testing#asap#benchmarking#blue-teamAI safety & security1
Help Net Security·22d agoBugBase Pentest Copilot Enterprise automates black-box pentesting#ai-agents#autonomous-pentesting#bugbaseTools 2 min
TechCrunch · Security·23d agoAbliteration.ai is making a business out of removing AI guardrails#abliteration#ai-safety#glm-5.3 6 min
Help Net Security·Aug 28, 2026What 90 days and a small budget can buy in AI agent security#ai-agent-security#gpu-infrastructure#mitre-atlas 11 min1
Help Net Security·Aug 19, 2026OpenAI puts major frontier AI training run on hold over cyber risks#ai-safety#alignment#astra 4 min