Towards Model-based Run-time Cybersecurity: On Control-Flow Anomaly Detection, Attack Identification, and Hardware Monitoring Authors: Martin Sachenbacher, Martin Leucker, Alexander Weiss, Aliyu Tanko Ali | Published: 2026-08-12 ハードウェアセキュリティ検証攻撃チェーン分析監視手法 2026.08.12 文献データベース
Learning to Persuade Exposes How Easily LLMs Abandon Correct Beliefs Authors: Nimet Beyza Bozdag, Emre Can Acikgoz, Gokhan Tur, Dilek Hakkani-Tür | Published: 2026-08-12 LLMの安全機構の解除心理的操作透かし 2026.08.12 文献データベース
On the Sensitivity to Errors in Homomorphic Computing: Single Transient Bit-flip Client-side Error Characterization Authors: Matías Mazzanti, Vattana Chan, Karthik Swaminathan, Augusto Vega, Esteban Mocskos, Radha Venkatagiri | Published: 2026-08-11 エラー耐性分析透かし透かしの耐久性 2026.08.11 文献データベース
REDAgentBench: Executable Red Teaming and Faithful Measurement of LLM Agent Systems Authors: Zixing Chen, Xingyuan Liu, Jie Zhu, Huaixia Dou, Shuo Jiang, Junhui Li, Lifan Guo, Feng Chen, Chi Zhang | Published: 2026-08-11 RAGへのポイズニング攻撃フレームワーク評価結果 2026.08.11 文献データベース
On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models Authors: Md Jafrin Hossain, Mohammad Arif Hossain, Nirwan Ansari | Published: 2026-08-11 インダイレクトプロンプトインジェクション脆弱性分析防御メカニズム 2026.08.11 文献データベース
SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning Authors: Caoyuan Ma, Wenpu Liu, Weichu Xie, Tian Gu, Shilei Zhao, Lingxi Min, Shuai Dong, Yuqi Xu, Ji Zhao, Ziyue Wang, Wenzheng Chang, Taiqiang Wu, Yongfu Zhu, Wenqi Shao, Yinqiang Zheng | Published: 2026-08-11 AIシステムの関係性パフォーマンス評価生成モデル特性 2026.08.11 文献データベース
From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Agents Authors: Caili Yu, Yiqi Wang, Jiaqi Zhang, Yiqun Duan, Mingkai Zheng, Zhangkai Wu, Kaize Shi, Taotao Cai | Published: 2026-08-11 エラー訂正ニューラルネットワークパフォーマンス評価メモリ防御問題 2026.08.11 文献データベース
Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models Authors: Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang | Published: 2026-08-11 モデルDoS攻撃者や悪意のあるデバイス音声アシスタントの誤作動 2026.08.11 文献データベース
Hidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action Models Authors: Jiahui Han, Yuhui Yao, Xin Wang, Jiafei Cao, Mingxuan Zhang, Danfeng Shan, Huiqi Deng, Guanchu Wang, Xia Hu | Published: 2026-08-11 モデルの堅牢性敵対的学習透かし 2026.08.11 文献データベース
Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research Authors: Lin Liao, Peng Li | Published: 2026-08-11 データ抽出と分析パフォーマンス評価評価結果 2026.08.11 文献データベース