When the World Lies: Backdoor Attacks on Latent World Models for Downstream Control Authors: Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta | Published: 2026-09-14 Trigger DetectionBackdoor AttackDetection of Poison Data for Backdoor Attacks 2026.09.14 2026.09.16 Literature Database
Don’t Send What You Don’t Need: Question-Guided Token Pruning as a Privacy Defense for Vision-Language Models Authors: Md Khalid Syfullah, Alvi Ataur Khalil | Published: 2026-09-14 Data Privacy ManagementVisual PrivacyEvaluation Method 2026.09.14 2026.09.16 Literature Database
Automating Attack Graph Construction for Agentic Pentesting. Towards Neuro-Symbolic Vulnerability Hunting Authors: Oliver Stevanovic, Jasmin Wachter | Published: 2026-09-14 Graph ConstructionCybersecurityAttack Graph Generation 2026.09.14 2026.09.16 Literature Database
Empirical Evaluation of Task-Based Permission Scoping Architecture for AI Agents Authors: Halil Burak Noyan | Published: 2026-09-14 アクセス制御モデルポリシー最適化Evaluation Method 2026.09.14 2026.09.16 Literature Database
Divide, Consult, Conquer: Capability Laundering Through Aligned LLMs Authors: Mark Russinovich, Blake Bullwinkel, Giorgio Severi, Cristian Ovadiuc, Ahmed Salem | Published: 2026-09-14 CybersecurityPrompt InjectionEvaluation Method 2026.09.14 2026.09.16 Literature Database
Clean Scores, Buried Evidence, and Confident Wrong: A Receipt-Based Audit of Frontier Agentic QA Authors: Luis M. Sánchez | Published: 2026-09-14 エラー解析監査トレースEvaluation Method 2026.09.14 2026.09.16 Literature Database
Why LLM Agents Collapse Without Oversight: The Enforcement Gap as the Mechanism Behind Emergence World Failures Authors: Yuhang Wang | Published: 2026-09-14 Indirect Prompt InjectionPrompt leaking監査トレース 2026.09.14 2026.09.16 Literature Database
SpliTEE: Improving LLM Inference on Trusted Hardware with Differentially Private GPU Outsourcing Authors: Shashie Dilhara Batan Arachchige, Robin Carpentier, Hassan Jameel Asghar, Dali Kaafar | Published: 2026-09-14 Prompt leakingDifferential PrivacyEvaluation Method 2026.09.14 2026.09.16 Literature Database
Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks Authors: Aashiq Muhamed, Mona T. Diab, Virginia Smith, Andrew Ilyas, Matthew Jagielski | Published: 2026-09-14 Backdoor AttackPoisoningEvaluation Method 2026.09.14 2026.09.16 Literature Database
PIDS-Bench: Evaluating Prompt-Injection Detectors Under Over-Defense, Obfuscation, and Distribution Shift Authors: Yusuf Khalid Shire, Sang-Chul Kim | Published: 2026-09-14 Indirect Prompt InjectionPrompt InjectionEvaluation Method 2026.09.14 2026.09.16 Literature Database