Literature Database

When the World Lies: Backdoor Attacks on Latent World Models for Downstream Control

Authors: Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta | Published: 2026-09-14
Trigger Detection
Backdoor Attack
Detection of Poison Data for Backdoor Attacks

Don’t Send What You Don’t Need: Question-Guided Token Pruning as a Privacy Defense for Vision-Language Models

Authors: Md Khalid Syfullah, Alvi Ataur Khalil | Published: 2026-09-14
Data Privacy Management
Visual Privacy
Evaluation Method

Automating Attack Graph Construction for Agentic Pentesting. Towards Neuro-Symbolic Vulnerability Hunting

Authors: Oliver Stevanovic, Jasmin Wachter | Published: 2026-09-14
Graph Construction
Cybersecurity
Attack Graph Generation

Empirical Evaluation of Task-Based Permission Scoping Architecture for AI Agents

Authors: Halil Burak Noyan | Published: 2026-09-14
アクセス制御モデル
ポリシー最適化
Evaluation Method

Divide, Consult, Conquer: Capability Laundering Through Aligned LLMs

Authors: Mark Russinovich, Blake Bullwinkel, Giorgio Severi, Cristian Ovadiuc, Ahmed Salem | Published: 2026-09-14
Cybersecurity
Prompt Injection
Evaluation Method

Clean Scores, Buried Evidence, and Confident Wrong: A Receipt-Based Audit of Frontier Agentic QA

Authors: Luis M. Sánchez | Published: 2026-09-14
エラー解析
監査トレース
Evaluation Method

Why LLM Agents Collapse Without Oversight: The Enforcement Gap as the Mechanism Behind Emergence World Failures

Authors: Yuhang Wang | Published: 2026-09-14
Indirect Prompt Injection
Prompt leaking
監査トレース

SpliTEE: Improving LLM Inference on Trusted Hardware with Differentially Private GPU Outsourcing

Authors: Shashie Dilhara Batan Arachchige, Robin Carpentier, Hassan Jameel Asghar, Dali Kaafar | Published: 2026-09-14
Prompt leaking
Differential Privacy
Evaluation Method

Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks

Authors: Aashiq Muhamed, Mona T. Diab, Virginia Smith, Andrew Ilyas, Matthew Jagielski | Published: 2026-09-14
Backdoor Attack
Poisoning
Evaluation Method

PIDS-Bench: Evaluating Prompt-Injection Detectors Under Over-Defense, Obfuscation, and Distribution Shift

Authors: Yusuf Khalid Shire, Sang-Chul Kim | Published: 2026-09-14
Indirect Prompt Injection
Prompt Injection
Evaluation Method