PaperScope
LIVE · 2026-09-03 05:40 UTC

attack 16 papers this week · -29% WoW

papers mentioning "attack" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1CodePoisonRAG: Knowledge Poisoning Attacks on Retrieval-Augmented Code GenerationVarun Gadey, Ziad Marey, Alexandra Dmitrienkocs.CR2026-09-02
2SPADE: SPaT Attack Detection from the Connected Vehicle's PerspectiveJames Di Novo, Hany Ragab, Sylvain P. Leblanccs.CR2026-09-02
3Learning-Based Reconstruction Attacks on Coordinate-Obfuscated Point CloudsMohammad Waquas Usmani, Susmit Shannigrahi, Michael Zinkcs.CR2026-09-02
#4CACTUS: Mask-Guided Semantic Clean-Label Backdoors in Decentralized Federated LearningChao Feng, Burkhard Stillercs.LG2026-09-02
#5Towards One-for-All Robustness Across a Continuum of Threat LevelsZhichao Hou, Xiaorui Liucs.LG2026-09-02
#6Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grounded Persuasion in Multi-Turn JailbreakingSiyu Chen, Haoran Wang, Xiaojian Li +3cs.CL2026-09-02
#7Poisoning Attacks on the PGM-indexAtsuki Sato, Martin Aumüller, Yusuke Matsuics.DB2026-09-02
#8Counter-GEO-Bench: Evaluating Defenses Against Information-Distorting Generative Engine OptimizationBing Zheng, Zongyao Zhao, Wenming Yangcs.IR2026-09-02
#9SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignmentQingyu Meng, Yiwei Zha, Jiahuan Pei +3cs.LG2026-09-02
#10CAPTURE: Disentangling Preference Drift from Memory Poisoning in Personalized LLM AgentsS M Asif Hossain, Ruksat Khan Shayoni, Md Kishor Morolcs.LG2026-09-02
#11InfraPatch: Cross-Task Targeted Grayscale Patch Attacks on Infrared-Adapted Vision-Language ModelsChengyin Hu, Dingyi Lu, Jiaju Han +5cs.CV2026-09-02
#12ASCII Attack: Recontextualising Harmful Requests as Artistic Critique in Large Language ModelsDa Cheng Gu, Yifei Dong, Xinghao Yang +2cs.AI2026-09-02
#13WeaveMark: Robust and Scalable Multi-bit LLM Watermarking via Coded Payload SpreadingGang-Hyun Park, Ju-Hyeong Lee, Hee-Youl Kwak +1cs.CR2026-09-02
#14Breadth Beats Depth: Improving GCG-Based Jailbreak Optimization with Breadth-Oriented Suffix SearchShiliang Xiao, Jingsong Wei, Yuzhi Liang +3cs.CL2026-09-02
#15C$^{3}$T: Counterfactual Causal Reasoning for Sentiment Shifts in Social-Media Conversation TreesS M Rafiuddin, Atriya Sencs.CL2026-09-02
#16Pushing Forward Multi-Secret-Key Homomorphic Encryption for Private Average AggregationMiguel Morona-Mínguez, Fernando Pérez-González, Alberto Pedrouzo-Ulloacs.CR2026-09-01
#17Agent Memory Is a Surface for Endogenous Authorization LaunderingTommaso Cerruti, Mika Okamoto, Ansel Kaplan Erolcs.CR2026-09-01
#18Hearing the Whispers: Black-Box Membership Inference Attacks on Finetuned TTS ModelsKunlin Cai, Kaiyuan Zhang, Zihang Xiang +4cs.CR2026-09-01
#19Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization EvaluationHimil Vasava, Ming Jiangcs.CL2026-09-01
#20Optimizing Byzantine Node Placement in Decentralized Federated LearningEdoardo Gabrielli, Gabriele Tolomeics.LG2026-09-01
#21Defense-as-Skill: Evolving Runtime Guard Skill for Skill-Augmented AgentsXiaofang Yang, Ziqi Miao, Dianbo Sui +2cs.CR2026-09-01
#22When Safety Routing Breaks: Understanding Alignment Fragility under Benign Fine-TuningYitong Guo, Xiaoyi Chen, Siyuan Zhang +2cs.CR2026-09-01
#23Gaussian Core LoRA: Distribution-Aware Dynamic Adaptation for Broad Concept ErasureQinghui Gong, Xunlei Chen, Yu-Xuan Zhang +2cs.CV2026-09-01
#24VerTox: Verifiable Reward-Guided Corpus Poisoning Against Neural Ranking ModelsZhiqi Huang, Vivek Datla, Zhichao Xu +3cs.CL2026-09-01
#25One Prompt Is Enough: Watermark Laundering Through Foundation Image ModelsJidong Yang, Qi Li, Wei Zong +5cs.CV2026-09-01
#26Explore More, Drift Less: Outcome-Only Reinforcement Learning Can Suffice for Long-Horizon Interactive AgentsLiming Pu, Xiaoxia Li, Yifu Liu +2cs.LG2026-09-01
#27Position Matters: Feature Inversion Attacks in ViT Split Inference with Token Reduction and ShufflingStefano Leggio, Giulio Rossolini, Alessandro Biondics.CR2026-09-01
#28Jailbreaking Text-to-Image Models Through Cracks: Navigating Heterogeneous Safety Filters via Multi-Agent DebateKaiyan Wen, Shijie Zhang, Lu Yu +1cs.AI2026-09-01
#29Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization AsymmetryShengfang Zhai, Leo Marchyok, Yuling Shi +4cs.CL2026-09-01
#30Forbid Your Attention: Fooling Multimodal Large Language Models by Selectively Removing Intrinsic Focus in Spectral DomainDaizong Liu, Junhao Dong, Zhiyuan Ma +6cs.CV2026-09-01
#31Triple-Bottom-Line Sustainability of Language Models for Edge AI: A Comparison Between SLMs and Quantized LLMsJainil Dharmil Shahcs.AI2026-09-01
#32SoK: When Safe Agents Fail Together: The Security of Multi Agent LLM SystemsRui Yang, Junjie Xu, Zhengyu Liu +4cs.CR2026-09-01
#33Same Semantics, Different Outcome: On the Modality Robustness of Multimodal LLMs under Knowledge ConflictJungyeon Lee, Yejin Yoon, Taeuk Kimcs.CL2026-09-01
#34The Safeguard Worked. Is the LLM System Safer?Pingyu Wu, Weiming Zhang, Nenghai Yucs.CR2026-09-01
#35Beyond Token Positions: Safety Alignment Across Denoising Steps in Diffusion Language ModelsGuoli Wang, Haonan Shi, Tu Ouyang +1cs.CL2026-08-31
#36EvoFlint: An Evolutionary Atlas of Multi-Turn LLM VulnerabilitiesFeitong Qiao, Liren Peng, Shiming Ren +7cs.CL2026-08-31
#37TRIS: A Tri-Layer Retrieval Integrity Sieve Against Knowledge PoisoningMuhaimin Bin Munir, Akib Jawad Ononto, Nazia Shehnaz Joynab +2cs.CL2026-08-31
#38Does Reasoning Mitigate Backdoor Attacks? A Neuro-Symbolic PerspectiveMarco Antonio Corallo, Andrea Agiollo, Mauro Conti +1cs.CR2026-08-31
#39Context Inference Attacks Without JailbreaksPrince Jha, Samuele Poppi, Nils Lukascs.CR2026-08-31
#40Workload Identification with Physical Side Channels for AI GovernanceSimone Gargiulo, Gabriel Kulpcs.CR2026-08-31
#41Delegation Without Trust: An Empirical Gap Analysis of Identity, Authorization, and Runtime Governance in Multi-Agent LLM SystemsPanduranga Sai Varma Dantuluri, Jyotirmoy Sundics.CR2026-08-31
#42Physical Adversarial Examples for Person Detectors in Thermal Images Based on 3D ModelingXiaopei Zhu, Siyuan Huang, Zhanhao Hu +3cs.CV2026-08-31
#43The Fragility of Jailbreak Robustness Across Operational StatesYuna Park, Hwang Youn Kim, Yujin Kim +3cs.CR2026-08-31
#44Beyond the Payload: How User Invocation Shapes Coding Agent Vulnerability to Repository PoisoningFukang Zhu, Binbin Zhao, Ruixiao Lin +3cs.CR2026-08-31
#45The Safety Relay in Roleplay Jailbreaks: A Component-Resolved Causal Analysis of Harm Recognition and RefusalMd Mokarram Chowdhury, Ernie Chang, Yang Lics.LG2026-08-31
#46EvoSkill Injection: Red-Teaming Autonomous Skill Generation and Evolution in Self-Evolving AgentsDoyun Kim, Chanwoo Kim, Sugyeong Eo +2cs.AI2026-08-31
#47Will the User Ever Know? Covert Indirect Prompt Injection Attacks on Tool-Using LLM AgentsYunseok Lee, Yunji Kim, Woojin Leecs.AI2026-08-31
#48Lazy Grounding: Attacking Search Agents with Factual EvidenceYulin Zhang, Yukun Huang, Sanxing Chen +4cs.CL2026-08-31
#49SIR: Self-improving Red-teaming for Compute Use AgentsChen Xiong, Zhiyuan He, Pin-Yu Chen +2cs.CR2026-08-31
#50Balancing Privacy, Utility, and Safety in LLM Alignment through Preference OptimizationDishu Yang, Jingjing Liu, Jize Lics.CR2026-08-31

all trends · matching is case-insensitive substring after tokenization