📝 Publications
Jailbreak
ACM MM 2026PVDetector: Detecting Prompt Injection Attacks on Purpose-Specific LLM Agents through Policy-Violation Concept Analysis, Junhui Wang, Hangtao Zhang, Zhirun Zheng, Li Zeng, Jiejun Xiao, Xi Luo, Lihua Yin, Saiqin LongUSENIX Security 2026Defending Jailbreak Attacks on Large Language Models via Manifold Trajectory Kinetics, Hangtao Zhang, Yucheng Zhao, Sishun Liu, Ziqi Zhou, Zeyu Ye, Wei Wan, Minghui Li, Shengshan Hu, Yanjun Zhang, Yi Liu, Leo Yu ZhangICLR 2025Badrobot: Jailbreaking Embodied LLM Agents in the physical world, Hangtao Zhang, Chenyu Zhu, Xianlong Wang, Ziqi Zhou, Changgan Yin, Minghui Li, Lulu Xue, Yichen Wang, Shengshan Hu, Aishan Liu, Peijin Guo, Leo Yu Zhang
🚪 Backdoor Attacks and Defenses
IJCAI 2024Detector Collapse: Backdooring Object Detection to Catastrophic Overload or Blindness, Hangtao Zhang, Shengshan Hu, Yichen Wang, Leo Yu Zhang, Ziqi Zhou, Xianlong Wang, Yanjun Zhang, Chao ChenTDSC 2024Reverse Backdoor Distillation: Towards Online Backdoor Attack Detection for Deep Neural Network Models, Zeming Yao, Hangtao Zhang, Yicheng Guo, Xin Tian, Wei Peng, Yi Zou, Leo Yu Zhang, Chao ChenCVPR 2025Test-Time Backdoor Detection for Object Detection Models, Hangtao Zhang, Yichen Wang, Shihui Yan, Chenyu Zhu, Ziqi Zhou, Linshan Hou, Shengshan Hu, Minghui Li, Yanjun Zhang, Leo Yu ZhangTIFSDarkHash: A Data-Free Backdoor Attack Against Deep Hashing, Ziqi Zhou, Menghao Deng, Yufei Song, Hangtao Zhang, Wei Wan, Shengshan Hu, Minghui Li, Leo Yu Zhang(In peer review)TrojanRobot: Physical-World Backdoor Attacks Against VLM-based Robotic Manipulation, Xianlong Wang, Hewen Pan, Hangtao Zhang, Minghui Li, Shengshan Hu, Ziqi Zhou, Lulu Xue, Peijin Guo, Yichen Wang, Wei Wan, Aishan Liu, Leo Zhang
😈 Poisoning attacks and Denfenses
ICML 2026Dual-branch Robust Unlearnable Examples, Xianlong Wang, Hangtao Zhang, Wenbo Pan, Ziqi Zhou, Changsong Jiang, Li Zeng, Xiaohua JiaNeurIPS 20243D Point Clouds: Class-wise Transformation Is All You Need, Xianlong Wang, Minghui Li, Wei Liu, Hangtao Zhang, Shengshan Hu, Yechao Zhang, Ziqi Zhou, Hai JinIJCAI 2023Denial-of-Service or Fine-Grained Control: Towards Flexible Model Poisoning Attacks on Federated Learning, Hangtao Zhang, Zeming Yao, Leo Yu Zhang, Shengshan Hu, Chao Chen, Alan Liew, Zhetao LiTDSC 2025Fine-Grained Poisoning Framework against Federated Learning, Minghui Li¹, Hangtao Zhang¹, Yanjun Zhang, Li Zeng, Chao Chen, Qiyun Shao, Wei Wan, Shengshan Hu, Leo Yu Zhang. (¹*Co-first authors)
🌌 Adversarial Attacks and Defenses
ACM MM 2026GhostPrompt: Cross-Image Adversarial Prompt for Vision-Language Models, Li Zeng, Zeyu Ye, Meng Xie, Hangtao Zhang, Xianlong Wang, Yanchun Li, Zhetao LiNeurIPS 2025AdvEDM: Fine-grained Adversarial Attack against VLM-based Embodied Decision-Making Systems, Yichen Wang, Hangtao Zhang, Hewen Pan, Ziqi Zhou, Xianlong Wang, Peijin Guo, Lulu Xue, Shengshan Hu, Minghui Li, Leo Yu ZhangACM MM 2023AdvCLIP: Downstream-agnostic Adversarial Examples in Multimodal Contrastive Learning, Ziqi Zhou, Shengshan Hu, Minghui Li, Hangtao Zhang, Yechao Zhang, Hai JinAAAI 2025Breaking Barriers in Physical-World Adversarial Examples: Improving Robustness and Transferability via Robust Feature, Yichen Wang, Yuxuan Zhou, Ziqi Zhou, Hangtao Zhang, Wei Wan, Shengshan Hu, Minghui LiIEEE Transactions on MultimediaSegTrans: Transferable Adversarial Examples for Segmentation Models, Yufei Song, Ziqi Zhou, Qi Lu, Hangtao Zhang, Yifan Hu, Lulu Xue, Shengshan Hu, Minghui Li, Leo Yu ZhangICASSP 2025PB-UAP: Hybrid Universal Adversarial Attack For Image Segmentation, Yufei Song, Ziqi Zhou, Minghui Li, Xianlong Wang, Hangtao Zhang, Menghao Deng, Wei Wan, Shengshan Hu, Leo Yu ZhangICME 2025PSFD: Proactive Spatial-Frequency Defense against Malicious Exemplar-Guided Image Editing, Li Zeng, Xiaojun Mo, Meng Xie, Hangtao Zhang, Yixiang Liu, Yezhuo Peng, Yanchun Li