Same Request, Different Boundary: Evaluating Cybersecurity Assistance across Conversational Contexts Authors: Rui Yang, Yang Hong, Yichao Xu, Zhengyu Liu, Ziyang Li, Yinzhi Cao | Published: 2026-09-01 データセットの影響実験プロトコル攻撃モデルの訓練 2026.09.01 文献データベース
The Safeguard Worked. Is the LLM System Safer? Authors: Pingyu Wu, Weiming Zhang, Nenghai Yu | Published: 2026-09-01 インダイレクトプロンプトインジェクションプロンプトインジェクション攻撃者の行動分析 2026.09.01 文献データベース
SingProbe Technical Report Authors: Sing Team | Published: 2026-08-31 ハルシネーション医療モニタリングシステム評価結果 2026.08.31 文献データベース
ECLIPSE: Self-Evolving Stealthy Prompt Injection Attack against Long-Horizon Agentic Systems Authors: Shiqian Zhao, Yangfan Zhou, Xinfeng Li, Runyi Hu, Yechao Zhang, Yi Xie, Tianwei Zhang, Luu Anh Tuan | Published: 2026-08-31 インダイレクトプロンプトインジェクションセキュリティ検証手法攻撃モデルの訓練 2026.08.31 文献データベース
EvoSkill Injection: Red-Teaming Autonomous Skill Generation and Evolution in Self-Evolving Agents Authors: Doyun Kim, Chanwoo Kim, Sugyeong Eo, Yeo-Chan Yoon, Chanjun Park | Published: 2026-08-31 インダイレクトプロンプトインジェクションプロンプトインジェクション能力進化の脅威 2026.08.31 文献データベース
Why Are LLM Backdoor Defenses Fragmented? A Feature-Level Explanation with Sparse Autoencoders Authors: Yizhe Zeng, Chenxu Niu, Wei Zhang, Hao Huang, Yunpeng Li, Dongxu Han, Dan Du, Cheng Hong, Hequn Xian, Yuling Liu | Published: 2026-08-31 バックドアモデルの検知ポイズニング攻撃防御手法の統合 2026.08.31 文献データベース
Will the User Ever Know? Covert Indirect Prompt Injection on Tool-Using LLM Agents Authors: Yunseok Lee, Yunji Kim, Woojin Lee | Published: 2026-08-31 インダイレクトプロンプトインジェクション攻撃モデルの訓練 2026.08.31 文献データベース
SIR: Self-improving Red-teaming for Compute Use Agents Authors: Chen Xiong, Zhiyuan He, Pin-Yu Chen, Stjepan Picek, Tsung-Yi Ho | Published: 2026-08-31 サイバーセキュリティの脅威探索的攻撃攻撃モデルの訓練 2026.08.31 文献データベース
Balancing Privacy, Utility, and Safety in LLM Alignment through Preference Optimization Authors: Dishu Yang, Jingjing Liu, Jize Li | Published: 2026-08-31 アライメントプライバシー評価手法メモリゼーションの測定 2026.08.31 文献データベース
RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution Authors: Junjie Zhang, Hui Liu, Kecheng Chen, Xianbo Mo, Changsheng Chen, Haoliang Li | Published: 2026-08-27 プロンプトインジェクション攻撃効果の評価脱獄攻撃手法 2026.08.27 文献データベース