arXiv cs.CR·4d agoExtracting CNNs in the Unknown-Architecture and Feedback-Agnostic Setting#model-extraction#cnn#cryptanalysisAI safety & security
arXiv cs.CR·5d agoGuidedRay: Diversity-Guided Direction Discovery for Targeted Hard-Label Black-Box Attacks#adversarial-examples#black-box#decision-based-attackResearch
arXiv cs.CR·5d agoFeedback Coding Enables Inference-Time Covert Agentic Communication#steganography#llm#covert-channelAI safety & security1
arXiv cs.AI / cs.LG / cs.CL·5d agoPinocchio: Fast Uncertainty Estimates for Black-Box Language Models#ai-model#black-box#calibrationAI research
arXiv cs.CR·5d agoReinforcement Learning Inspired Black-box Adversarial Attacks for Computer Vision#adversarial-attack#black-box#reinforcement-learningAI safety & security
arXiv cs.CR·6d agoFrom Bits to Beliefs: Recoverable Semantic Fingerprints for Black-Box Verification of Large Language Models#llm#ownership-verification#fingerprintingResearch
arXiv cs.CR·15d agoForging Tree-Ring: Reproducing and Instrumenting Black-Box Semantic Watermark Forgery#black-box#diffusion-models#forgeryResearch