SpatialJB: How Text Distribution Art Becomes the “Jailbreak Key” for LLM Guardrails Authors: Zhiyi Mou, Jingyuan Yang, Zeheng Qian, Wangze Ni, Tianfang Xiao, Ning Liu, Chen Zhang, Zhan Qin, Kui Ren | Published: 2026-01-14 LLM活用プロンプトインジェクション大規模言語モデル 2026.01.14 文献データベース
HoneyTrap: Deceiving Large Language Model Attackers to Honeypot Traps with Resilient Multi-Agent Defense Authors: Siyuan Li, Xi Lin, Jun Wu, Zehao Liu, Haoyu Li, Tianjie Ju, Xiang Chen, Jianhua Li | Published: 2026-01-07 プロンプトインジェクション大規模言語モデル敵対的攻撃検出 2026.01.07 文献データベース
Jailbreaking LLMs & VLMs: Mechanisms, Evaluation, and Unified Defense Authors: Zejian Chen, Chaozhuo Li, Chao Li, Xi Zhang, Litian Zhang, Yiming He | Published: 2026-01-07 プロンプトインジェクション大規模言語モデル敵対的攻撃検出 2026.01.07 文献データベース
On the Effectiveness of Instruction-Tuning Local LLMs for Identifying Software Vulnerabilities Authors: Sangryu Park, Gihyuk Ko, Homook Cho | Published: 2025-12-23 プロンプトインジェクション大規模言語モデル脆弱性分析 2025.12.23 文献データベース
Large Language Models as a (Bad) Security Norm in the Context of Regulation and Compliance Authors: Kaspar Rosager Ludvigsen | Published: 2025-12-18 LLM活用インダイレクトプロンプトインジェクション大規模言語モデル 2025.12.18 文献データベース
FlipLLM: Efficient Bit-Flip Attacks on Multimodal LLMs using Reinforcement Learning Authors: Khurram Khalil, Khaza Anuarul Hoque | Published: 2025-12-10 プロンプトインジェクション大規模言語モデル脆弱性評価手法 2025.12.10 文献データベース
Attention is All You Need to Defend Against Indirect Prompt Injection Attacks in LLMs Authors: Yinan Zhong, Qianhao Miao, Yanjiao Chen, Jiangyi Deng, Yushi Cheng, Wenyuan Xu | Published: 2025-12-09 インダイレクトプロンプトインジェクションプロンプトの検証大規模言語モデル 2025.12.09 文献データベース
SoK: a Comprehensive Causality Analysis Framework for Large Language Model Security Authors: Wei Zhao, Zhe Li, Jun Sun | Published: 2025-12-04 プロンプトインジェクション因果推論大規模言語モデル 2025.12.04 文献データベース
Benchmarking and Understanding Safety Risks in AI Character Platforms Authors: Yiluo Wei, Peixian Zhang, Gareth Tyson | Published: 2025-12-01 キャラクターのメタデータ収集リスク評価大規模言語モデル 2025.12.01 文献データベース
Adversarial Attack-Defense Co-Evolution for LLM Safety Alignment via Tree-Group Dual-Aware Search and Optimization Authors: Xurui Li, Kaisong Song, Rui Zhu, Pin-Yu Chen, Haixu Tang | Published: 2025-11-24 プロンプトインジェクション大規模言語モデル悪意のあるプロンプト 2025.11.24 文献データベース