文献データベース

How Much Can We Trust LLM Search Agents? Measuring Endorsement Vulnerability to Web Content Manipulation

Authors: Yimeng Chen, Zhe Ren, Firas Laakom, Yu Li, Dandan Guo, Jürgen Schmidhuber | Published: 2026-06-15
インダイレクトプロンプトインジェクション
データ駆動型脆弱性評価
自律エージェントセキュリティ

Adaptive and Explicit safe: Triggering Latent Safety Awareness in Large Reasoning Models

Authors: Ke Miao, Jiaxin Li, Hongliang Chen, Yuke Hu, Zhan Qin | Published: 2026-06-15
プロンプトリーキング
リスク管理
安全性向上手法

Automated jailbreak attack targeting multiple defense strategies

Authors: Qi Wang, Chengcheng Wan, Weijia He, Yanqing Li, Hanqi Sun, Xiaodong Gu, Jiangtao Wang | Published: 2026-06-15
ロバスト性向上
大規模言語モデル
防御手法の統合

Robust and Automated Reconfiguration of Byzantine Wide-Area Replication

Authors: Rowdy Chotkan, Bulat Nasrulin, Johan Pouwelse, Jérémie Decouchant | Published: 2026-06-15
ビザンチン攻撃対策
ロバスト性向上
最適化手法

ARB4WM: An Adversarial Robustness Benchmark for World Models in Continuous Control

Authors: Junjian Zhang, Hao Tan, Ruonan Li, Dong Zhu, Aiping Li, Zhaoquan Gu | Published: 2026-06-15
ロバスト性向上
ロバスト性向上手法
敵対的攻撃

DoubtProbe: Black-Box Jailbreak Defense via Structural Verification and Semantic Auditing

Authors: Xuanyu Yin, Yilin Jiang, Jun Zhou, Kai Chen, Zhengfu Cao, Xiaolei Dong | Published: 2026-06-15
大規模言語モデル
構造的パターン検出
防御手法の統合

FEnc$^2$: Unifying Data Packing for Efficient Private Inference via Convolution and Architecture-Aware Fragment Encoding

Authors: Ran Ran, Zhaoting Gong, Nuo Xu, Yuanchao Xu, Fan Yao, Wujie Wen | Published: 2026-06-15
FHEの最適化
パフォーマンス評価
最適化手法

The Proxy Knows Too Much: Sealing LLM API Routers with Attested TEEs

Authors: Sipeng Xie, Qianhong Wu, Hengrun Lu, Ziliang Sun, Qi Wu, Bo Qin, Qin Wang | Published: 2026-06-15
データ中心のセキュリティ
監査手法
自律エージェントセキュリティ

Gaming-Resistant Insurance Contracts for Autonomous AI Agents: Strategy-Proof Toll Mechanism Design

Authors: Hao-Hsuan Chen | Published: 2026-06-15
インセンティブメカニズム
リスク管理
自律エージェントセキュリティ

SPARK: Security Knowledge Priming and Representation-Guided Knowledge Activation for LLM-based Secure Code Generation

Authors: Xiaoyun Xu, Lichao Wu, Jona te Lintelo, Siyu Zhang, Stjepan Picek | Published: 2026-06-15
LLMの応用
データ駆動型脆弱性評価
プロンプトリーキング