How Much Can We Trust LLM Search Agents? Measuring Endorsement Vulnerability to Web Content Manipulation Authors: Yimeng Chen, Zhe Ren, Firas Laakom, Yu Li, Dandan Guo, Jürgen Schmidhuber | Published: 2026-06-15 インダイレクトプロンプトインジェクションデータ駆動型脆弱性評価自律エージェントセキュリティ 2026.06.15 文献データベース
Adaptive and Explicit safe: Triggering Latent Safety Awareness in Large Reasoning Models Authors: Ke Miao, Jiaxin Li, Hongliang Chen, Yuke Hu, Zhan Qin | Published: 2026-06-15 プロンプトリーキングリスク管理安全性向上手法 2026.06.15 文献データベース
Automated jailbreak attack targeting multiple defense strategies Authors: Qi Wang, Chengcheng Wan, Weijia He, Yanqing Li, Hanqi Sun, Xiaodong Gu, Jiangtao Wang | Published: 2026-06-15 ロバスト性向上大規模言語モデル防御手法の統合 2026.06.15 文献データベース
Robust and Automated Reconfiguration of Byzantine Wide-Area Replication Authors: Rowdy Chotkan, Bulat Nasrulin, Johan Pouwelse, Jérémie Decouchant | Published: 2026-06-15 ビザンチン攻撃対策ロバスト性向上最適化手法 2026.06.15 文献データベース
ARB4WM: An Adversarial Robustness Benchmark for World Models in Continuous Control Authors: Junjian Zhang, Hao Tan, Ruonan Li, Dong Zhu, Aiping Li, Zhaoquan Gu | Published: 2026-06-15 ロバスト性向上ロバスト性向上手法敵対的攻撃 2026.06.15 文献データベース
DoubtProbe: Black-Box Jailbreak Defense via Structural Verification and Semantic Auditing Authors: Xuanyu Yin, Yilin Jiang, Jun Zhou, Kai Chen, Zhengfu Cao, Xiaolei Dong | Published: 2026-06-15 大規模言語モデル構造的パターン検出防御手法の統合 2026.06.15 文献データベース
FEnc$^2$: Unifying Data Packing for Efficient Private Inference via Convolution and Architecture-Aware Fragment Encoding Authors: Ran Ran, Zhaoting Gong, Nuo Xu, Yuanchao Xu, Fan Yao, Wujie Wen | Published: 2026-06-15 FHEの最適化パフォーマンス評価最適化手法 2026.06.15 文献データベース
The Proxy Knows Too Much: Sealing LLM API Routers with Attested TEEs Authors: Sipeng Xie, Qianhong Wu, Hengrun Lu, Ziliang Sun, Qi Wu, Bo Qin, Qin Wang | Published: 2026-06-15 データ中心のセキュリティ監査手法自律エージェントセキュリティ 2026.06.15 文献データベース
Gaming-Resistant Insurance Contracts for Autonomous AI Agents: Strategy-Proof Toll Mechanism Design Authors: Hao-Hsuan Chen | Published: 2026-06-15 インセンティブメカニズムリスク管理自律エージェントセキュリティ 2026.06.15 文献データベース
SPARK: Security Knowledge Priming and Representation-Guided Knowledge Activation for LLM-based Secure Code Generation Authors: Xiaoyun Xu, Lichao Wu, Jona te Lintelo, Siyu Zhang, Stjepan Picek | Published: 2026-06-15 LLMの応用データ駆動型脆弱性評価プロンプトリーキング 2026.06.15 文献データベース