文献データベース

Towards Model-based Run-time Cybersecurity: On Control-Flow Anomaly Detection, Attack Identification, and Hardware Monitoring

Authors: Martin Sachenbacher, Martin Leucker, Alexander Weiss, Aliyu Tanko Ali | Published: 2026-08-12
ハードウェアセキュリティ検証
攻撃チェーン分析
監視手法

Learning to Persuade Exposes How Easily LLMs Abandon Correct Beliefs

Authors: Nimet Beyza Bozdag, Emre Can Acikgoz, Gokhan Tur, Dilek Hakkani-Tür | Published: 2026-08-12
LLMの安全機構の解除
心理的操作
透かし

On the Sensitivity to Errors in Homomorphic Computing: Single Transient Bit-flip Client-side Error Characterization

Authors: Matías Mazzanti, Vattana Chan, Karthik Swaminathan, Augusto Vega, Esteban Mocskos, Radha Venkatagiri | Published: 2026-08-11
エラー耐性分析
透かし
透かしの耐久性

REDAgentBench: Executable Red Teaming and Faithful Measurement of LLM Agent Systems

Authors: Zixing Chen, Xingyuan Liu, Jie Zhu, Huaixia Dou, Shuo Jiang, Junhui Li, Lifan Guo, Feng Chen, Chi Zhang | Published: 2026-08-11
RAGへのポイズニング攻撃
フレームワーク
評価結果

On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models

Authors: Md Jafrin Hossain, Mohammad Arif Hossain, Nirwan Ansari | Published: 2026-08-11
インダイレクトプロンプトインジェクション
脆弱性分析
防御メカニズム

SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning

Authors: Caoyuan Ma, Wenpu Liu, Weichu Xie, Tian Gu, Shilei Zhao, Lingxi Min, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng Chang, Taiqiang Wu, Yongfu Zhu, Wenqi Shao, Yinqiang Zheng | Published: 2026-08-11
AIシステムの関係性
パフォーマンス評価
生成モデル特性

From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Agents

Authors: Caili Yu, Yiqi Wang, Jiaqi Zhang, Yiqun Duan, Mingkai Zheng, Zhangkai Wu, Kaize Shi, Taotao Cai | Published: 2026-08-11
エラー訂正ニューラルネットワーク
パフォーマンス評価
メモリ防御問題

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

Authors: Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang | Published: 2026-08-11
モデルDoS
攻撃者や悪意のあるデバイス
音声アシスタントの誤作動

Hidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action Models

Authors: Jiahui Han, Yuhui Yao, Xin Wang, Jiafei Cao, Mingxuan Zhang, Danfeng Shan, Huiqi Deng, Guanchu Wang, Xia Hu | Published: 2026-08-11
モデルの堅牢性
敵対的学習
透かし

Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research

Authors: Lin Liao, Peng Li | Published: 2026-08-11
データ抽出と分析
パフォーマンス評価
評価結果