モデルDoS

Breaking the weakest link to evade vision language models

Authors: Ilan Zini, Boussad Addad, Katarzyna Kapusta | Published: 2026-08-19
モデルDoS
モデルの頑健性保証
敵対的攻撃手法

SMTrap: Cost-Effective DoS Attacks Against Large Reasoning Models via SMT Conflict Guidance

Authors: Jian Yang, Zhenqi Feng, Zhaoyang Yu, Zhaoxin Fan, Kejian Wu, Xiaofeng Wang, Zheng Zhu, Jianjun Huang, Wei You, Bin Liang | Published: 2026-08-19
SATソルバー
プロンプトインジェクション
モデルDoS

COMIC: Reference-Aware Safety Gating for Multimodal Large Language Models

Authors: Md Abdullahil Oaphy, Anhao Xiang, Zongxing Xie, Huayue Gu, Chenyu Wang, Honghui Xu | Published: 2026-08-18
セキュリティ課題
プロンプトインジェクション
モデルDoS

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

Authors: Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang | Published: 2026-08-11
モデルDoS
攻撃者や悪意のあるデバイス
音声アシスタントの誤作動

EntailLLM: Verifying LLM-Generated Vulnerability Discovery Paths with Domain Knowledge via Logic Programming

Authors: Kaustuv Mukherji, Jaikrishna Manojkumar Patil, Colton Payne, Paulo Shakarian, Dana Warmsley, Nigel Stepp, Evelyn Kim | Published: 2026-08-03
バイナリ分析
モデルDoS
脆弱性検出手法

Technical Report on the CVPR 2026@AdvML Workshop Challenge

Authors: Tianyuan Zhang, Zonglei Jing, Jiangfan Liu, Ligong Zhang, Ke Ma, Chengzhi Sun, Xiaohai Xu, Zhirui Zhang, Qianqian Xu, Qingming Huang, Hanyu Fang, Junhua Liu, Zheng Wang, Xiaoliang Liu, Yuanbo Li, Shuai Gui, Bin Wang, Menghe Zheng, Jing Nie, Hanyang Meng, Zeyang Zhang, Xiang Zhang, Yongxuan Zhu, Rui Ding, Hainan Li, Yongkang Zhang, Zhilei Zhu, Xianglong Kong, Jin Hu, Zonghao Ying, Yisong Xiao, Lei Chen, Haotong Qin, Jiakai Wang, Aishan Liu, Ruikai Li, Julia Karbing, Yinpeng Dong, Zhenfei Yin, Shao Jing, Xia Hu, Jingyi Xu, Juntao Dai, Xinyun Chen, Vishal M. Patel, Xianglong Liu, Dawn Song, Alan Yuille, Philip H. S. Torr, Dacheng Tao | Published: 2026-07-13
モデルDoS
攻撃手法評価
評価手法

Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models

Authors: Abrar Alotaibi, Moataz Ahmed | Published: 2026-06-25
LLMの安全機構の解除
データ生成手法
モデルDoS

SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?

Authors: Hwiwon Lee, Jiawei Liu, Dongjun Kim, Ziqi Zhang, Chunqiu Steven Xia, Lingming Zhang | Published: 2026-05-26
データセット評価
モデルDoS
ロバスト性評価

EVA: Editing for Versatile Alignment against Jailbreaks

Authors: Yi Wang, Hongye Qiu, Yue Xu, Sibei Yang, Zhan Qin, Minlie Huang, Wenjie Wang | Published: 2026-05-14
LLMセキュリティ
モデルDoS
安全性に関連するマルチモーダルなアプローチ

Defenses at Odds: Measuring and Explaining Defense Conflicts in Large Language Models

Authors: Xiangtao Meng, Wenyu Chen, Chuanchao Zang, Xinyu Gao, Jianing Wang, Li Wang, Zheng Li, Shanqing Guo | Published: 2026-05-14
AIによる出力のバイアスの検出
データ保護手法
モデルDoS