Model DoS

Breaking the weakest link to evade vision language models

Authors: Ilan Zini, Boussad Addad, Katarzyna Kapusta | Published: 2026-08-19
Model DoS
Certified Robustness
Adversarial Attack Methods

SMTrap: Cost-Effective DoS Attacks Against Large Reasoning Models via SMT Conflict Guidance

Authors: Jian Yang, Zhenqi Feng, Zhaoyang Yu, Zhaoxin Fan, Kejian Wu, Xiaofeng Wang, Zheng Zhu, Jianjun Huang, Wei You, Bin Liang | Published: 2026-08-19
SATソルバー
Prompt Injection
Model DoS

COMIC: Reference-Aware Safety Gating for Multimodal Large Language Models

Authors: Md Abdullahil Oaphy, Anhao Xiang, Zongxing Xie, Huayue Gu, Chenyu Wang, Honghui Xu | Published: 2026-08-18
セキュリティ課題
Prompt Injection
Model DoS

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

Authors: Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang | Published: 2026-08-11
Model DoS
Attackers and Malicious Devices
Malfunction of Voice Assistants

EntailLLM: Verifying LLM-Generated Vulnerability Discovery Paths with Domain Knowledge via Logic Programming

Authors: Kaustuv Mukherji, Jaikrishna Manojkumar Patil, Colton Payne, Paulo Shakarian, Dana Warmsley, Nigel Stepp, Evelyn Kim | Published: 2026-08-03
バイナリ分析
Model DoS
脆弱性検出手法

Technical Report on the CVPR 2026@AdvML Workshop Challenge

Authors: Tianyuan Zhang, Zonglei Jing, Jiangfan Liu, Ligong Zhang, Ke Ma, Chengzhi Sun, Xiaohai Xu, Zhirui Zhang, Qianqian Xu, Qingming Huang, Hanyu Fang, Junhua Liu, Zheng Wang, Xiaoliang Liu, Yuanbo Li, Shuai Gui, Bin Wang, Menghe Zheng, Jing Nie, Hanyang Meng, Zeyang Zhang, Xiang Zhang, Yongxuan Zhu, Rui Ding, Hainan Li, Yongkang Zhang, Zhilei Zhu, Xianglong Kong, Jin Hu, Zonghao Ying, Yisong Xiao, Lei Chen, Haotong Qin, Jiakai Wang, Aishan Liu, Ruikai Li, Julia Karbing, Yinpeng Dong, Zhenfei Yin, Shao Jing, Xia Hu, Jingyi Xu, Juntao Dai, Xinyun Chen, Vishal M. Patel, Xianglong Liu, Dawn Song, Alan Yuille, Philip H. S. Torr, Dacheng Tao | Published: 2026-07-13
Model DoS
攻撃手法評価
Evaluation Method

Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models

Authors: Abrar Alotaibi, Moataz Ahmed | Published: 2026-06-25
Disabling Safety Mechanisms of LLM
Data Generation Method
Model DoS

SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?

Authors: Hwiwon Lee, Jiawei Liu, Dongjun Kim, Ziqi Zhang, Chunqiu Steven Xia, Lingming Zhang | Published: 2026-05-26
Dataset evaluation
Model DoS
Robustness Evaluation

EVA: Editing for Versatile Alignment against Jailbreaks

Authors: Yi Wang, Hongye Qiu, Yue Xu, Sibei Yang, Zhan Qin, Minlie Huang, Wenjie Wang | Published: 2026-05-14
LLM Security
Model DoS
安全性に関連するマルチモーダルなアプローチ

Defenses at Odds: Measuring and Explaining Defense Conflicts in Large Language Models

Authors: Xiangtao Meng, Wenyu Chen, Chuanchao Zang, Xinyu Gao, Jianing Wang, Li Wang, Zheng Li, Shanqing Guo | Published: 2026-05-14
Bias Detection in AI Output
Data Protection Method
Model DoS