文献データベース

PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents

Authors: Seongjae Kang, Taehyung Yu, Sung Ju Hwang | Published: 2026-08-20
タスク成功率分析
形式的検証
進捗追跡

TempJail: Temporal Jailbreak Attack against Large Vision-Language Models via Subtitle Scheduling

Authors: Ling Zhou, Yihao Huang, Jingling Sun, Zhiwen Tian, Yi Zeng, Qihe Liu, Shijie Zhou | Published: 2026-08-20
プロンプトインジェクション
攻撃手法評価
深層学習モデル

A Locally Tokenized Generative Model for Robust Time-Series Watermarking

Authors: Dongbin Kim, Geonwoo Shin, Yujin Choi, Soyeon Park, Jaewook Lee | Published: 2026-08-20
信頼性評価
深層ネットワークの堅牢性
深層学習モデル

SiNMULI: Novel Signed Network Approach for Malicious URL Identification

Authors: Avijit Gayen, Sayan Mondal, Angshuman Jana | Published: 2026-08-19
データセット分析
悪意のあるURL検出
計算複雑性

Beyond the Transcript: Detecting Covert Co ordination in Latent Multi-Agent Communication

Authors: Ramneet Kaur, Pradyumna Chari, Ramesh Raskar, Jugad Singh, Sumit Kumar Jha, Anirban Roy | Published: 2026-08-19
マルチエージェントシステム
攻撃手法評価
異常検知アルゴリズム

Detecting Backdoors in Object Detection via Pre-NMS Prediction Distribution Shift

Authors: Longtian Wang, Zhengyu Zhao, Chenhao Lin, Le Yang, Shiwei Wang, Yuhan Zhi, Xiaofei Xie, Chao Shen | Published: 2026-08-19
バックドア攻撃
バックドア攻撃対策
深層学習モデル

From Threat Intelligence to Detection: Knowledge-driven Enrichment and Template-based Rule Grounding for Automated Sigma Rule Generation

Authors: Sepehr Ghaffarzadegan, Boubakr Nour, Makan Pourzandi, Mourad Debbabi, Chadi Assi | Published: 2026-08-19
AIによる出力のバイアスの検出
サイバー脅威
攻撃手法評価

Breaking the weakest link to evade vision language models

Authors: Ilan Zini, Boussad Addad, Katarzyna Kapusta | Published: 2026-08-19
モデルDoS
モデルの頑健性保証
敵対的攻撃手法

SMTrap: Cost-Effective DoS Attacks Against Large Reasoning Models via SMT Conflict Guidance

Authors: Jian Yang, Zhenqi Feng, Zhaoyang Yu, Zhaoxin Fan, Kejian Wu, Xiaofeng Wang, Zheng Zhu, Jianjun Huang, Wei You, Bin Liang | Published: 2026-08-19
SATソルバー
プロンプトインジェクション
モデルDoS

Verifiable abstention makes AI leak diagnosis accountable in water distribution networks

Authors: Tianwei Mu, Yue Wang, Mingzhe Yuan, Manhong Huang, Wenhong Wang, Xuerui Yin, Qing Luo, Min Xiao, Hui Yang, Jun Li, Dan Xue | Published: 2026-08-19
データ収集手法
信頼性評価
異常検知アルゴリズム