文献データベース

Exploiting LLM Agent Supply Chains via Payload-less Skills

Authors: Xinyu Liu, Yukai Zhao, Xing Hu, Xin Xia | Published: 2026-05-14
LLMセキュリティ
インダイレクトプロンプトインジェクション
攻撃手法

Watermarking Game-Playing Agents in Perfect-Information Extensive-Form Games

Authors: Juho Kim, Fei Fang, Tuomas Sandholm | Published: 2026-05-14
生成AI向け電子透かし
行動解析手法
透かし設計

Identifying AI Web Scrapers Using Canary Tokens

Authors: Steven Seiden, Triss Ren, Caroline Zhang, Taein Kim, Enze Liu, Emily Wenger | Published: 2026-05-13
LLMセキュリティ
データ抽出と分析
ユーザー行動分析

Model-Agnostic Lifelong LLM Safety via Externalized Attack-Defense Co-Evolution

Authors: Xiaozhe Zhang, Chaozhuo Li, Hui Liu, Shaocheng Yan, Bingyu Yan, Qiwei Ye, Haoliang Li | Published: 2026-05-13
LLMの安全機構の解除
アライメント
行動解析手法

Empowering IoT Security: On-Device Intrusion Detection in Resource Constrained Devices

Authors: Vasilis Ieropoulos, Eirini Anthi, Theodoros Spyridopoulos, Pete Burnap, Aftab Khan, Pietro Carnelli | Published: 2026-05-13
IoTサイバーセキュリティ
データ保護手法
機械学習の応用

Quantifying LLM Safety Degradation Under Repeated Attacks Using Survival Analysis

Authors: Zvi Topol | Published: 2026-05-13
LLMセキュリティ
プロンプトインジェクション
行動解析手法

Persona-Model Collapse in Emergent Misalignment

Authors: Davi Bastos Costa, Renato Vicente | Published: 2026-05-13
データセット評価
ユーザー行動分析
行動解析手法

HE-PIM: Demystifying Homomorphic Operations on a Real-world Processing-in-Memory System

Authors: Harshita Gupta, Mayank Kabra, Jaewoo Park, Priyam Mehta, Phillip Widdowson, Tathagata Barik, Nisa Bostancı, Konstantinos Kanellopoulos, Juan Gómez-Luna, Antonio J. Peña, Mohammad Sadrosadati, Onur Mutlu | Published: 2026-05-13
効率評価
計算複雑性
透かし設計

SoK: Unlearnability and Unlearning for Model Dememorization

Authors: Mengying Zhang, Derui Wang, Ruoxi Sun, Xiaoyu Xia, Shuang Hao, Minhui Xue | Published: 2026-05-12
データ保護手法
モデルの頑健性保証
モデル保護手法

FlowSteer: Prompt-Only Workflow Steering Exposes Planning-Time Vulnerabilities in Multi-Agent LLM Systems

Authors: Fanxiao Li, Jiaying Wu, Tingchao Fu, Natasha Jaques, Wei Zhou, Min-Yen Kan | Published: 2026-05-12
インダイレクトプロンプトインジェクション
データ中心のセキュリティ
多エージェントシステムの評価