Literature Database

Towards Model-based Run-time Cybersecurity: On Control-Flow Anomaly Detection, Attack Identification, and Hardware Monitoring

Authors: Martin Sachenbacher, Martin Leucker, Alexander Weiss, Aliyu Tanko Ali | Published: 2026-08-12
ハードウェアセキュリティ検証
Attack Chain Analysis
監視手法

Learning to Persuade Exposes How Easily LLMs Abandon Correct Beliefs

Authors: Nimet Beyza Bozdag, Emre Can Acikgoz, Gokhan Tur, Dilek Hakkani-Tür | Published: 2026-08-12
Disabling Safety Mechanisms of LLM
Psychological Manipulation
Watermark

On the Sensitivity to Errors in Homomorphic Computing: Single Transient Bit-flip Client-side Error Characterization

Authors: Matías Mazzanti, Vattana Chan, Karthik Swaminathan, Augusto Vega, Esteban Mocskos, Radha Venkatagiri | Published: 2026-08-11
エラー耐性分析
Watermark
Watermark Robustness

REDAgentBench: Executable Red Teaming and Faithful Measurement of LLM Agent Systems

Authors: Zixing Chen, Xingyuan Liu, Jie Zhu, Huaixia Dou, Shuo Jiang, Junhui Li, Lifan Guo, Feng Chen, Chi Zhang | Published: 2026-08-11
Poisoning attack on RAG
Framework
評価結果

On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models

Authors: Md Jafrin Hossain, Mohammad Arif Hossain, Nirwan Ansari | Published: 2026-08-11
Indirect Prompt Injection
Vulnerability Analysis
Defense Mechanism

SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning

Authors: Caoyuan Ma, Wenpu Liu, Weichu Xie, Tian Gu, Shilei Zhao, Lingxi Min, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng Chang, Taiqiang Wu, Yongfu Zhu, Wenqi Shao, Yinqiang Zheng | Published: 2026-08-11
Relationship of AI Systems
Performance Evaluation
Generative Model Characteristics

From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Agents

Authors: Caili Yu, Yiqi Wang, Jiaqi Zhang, Yiqun Duan, Mingkai Zheng, Zhangkai Wu, Kaize Shi, Taotao Cai | Published: 2026-08-11
Error-Correcting Neural Network
Performance Evaluation
メモリ防御問題

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

Authors: Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang | Published: 2026-08-11
Model DoS
Attackers and Malicious Devices
Malfunction of Voice Assistants

Hidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action Models

Authors: Jiahui Han, Yuhui Yao, Xin Wang, Jiafei Cao, Mingxuan Zhang, Danfeng Shan, Huiqi Deng, Guanchu Wang, Xia Hu | Published: 2026-08-11
Model Robustness
Adversarial Learning
Watermark

Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research

Authors: Lin Liao, Peng Li | Published: 2026-08-11
Data Extraction and Analysis
Performance Evaluation
評価結果