Literature Database

Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

Authors: Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino | Published: 2026-08-03
Relationship of AI Systems
Risk Management
行動保証

Cybersecurity Detection Classification with Reasoning-enabled Language Models

Authors: Amol Khanna, Manu Nandan, Cristian Viorel Popa, Joan Pujol-Roig, Diana Bolocan, Laura Vasilie, Alexandru Apostu, Chase Helwig, Mihaela Gaman, Michael Brautbar, Edward Raff, Chase Midler, Sven Krasser | Published: 2026-07-30
Prompt Injection
Model Evaluation
Trust Evaluation

Teffic-Audio: Tell Fact from Fiction

Authors: Wan Lin, Li Wang, Jindong Wang, Kunyu Feng, Zhizheng Wu | Published: 2026-07-30
Dataset evaluation
Data Augmentation Techniques
Performance Evaluation Method

Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation

Authors: Fazhong Liu, Zhuoyan Chen, Haozhen Tan, Yan Meng, Guoxing Chen, Haojin Zhu | Published: 2026-07-30
Certified Robustness
Risk Management
Adversarial Attack Methods

Piggybacking on Perception: Stealthy Concurrent Audio Prompt Injections against Multimodal LLM Agents

Authors: Mingxiao Liu, Yitong Li, Haoren Zhao, Yaoxiang Bian, Jianan Ma, Jian Zhang, Jialuo Chen, Xinhao Deng, Zhen Wang | Published: 2026-07-30
Indirect Prompt Injection
攻撃効果の評価
Security of Voice Recognition Systems

Agent Harness Distillation: Inference-Time Harness Extraction and Exploitation in Autonomous Multi-Agent Systems

Authors: Yu Cui, Wuli Yang, Yirui Shi, Junhao Xia, Hui Jiang, Lei Gao, Chenfu Bao | Published: 2026-07-30
攻撃効果の評価
Evaluation Method
Watermark Evaluation

MIND: Lightweight and Effective Memory Injection Defense for LLM Agents via Intent-Aware Information Bottleneck

Authors: Dongyi Liu, Haixing He, Xiaobao Wu, Jia Li | Published: 2026-07-30
Prompt leaking
メモリ防御問題
Detection of Poisonous Data

Temporal Poisoning: Clean-Label Backdoors via Event Redistribution in SNNs

Authors: Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta | Published: 2026-07-30
Backdoor Attack
攻撃モデルの訓練
Detection of Poisonous Data

Generalization and Trade-off in Adversarial Training: An RKHS Perspective via Kernel Integral Operators

Authors: Yiling Xie, Xiaoming Huo | Published: 2026-07-30
Performance Evaluation Metrics
Adversarial Learning
Regularization

Driving up Inference Energy on SNNs: Per-Sample and Universal Sponge Attacks

Authors: Spyridon Raptis, Haralampos-G. Stratigopoulos | Published: 2026-07-30
Trigger Detection
Performance Evaluation Metrics
Vulnerability Research