文献データベース

DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model

Authors: Wenhao Lin, Chenyu Yu, Xingwei Lin, Sicong Cao, Xiang Chen, Lei Xue, Le Yu, Letian Sha, Chunming Wu | Published: 2026-08-06
インダイレクトプロンプトインジェクション
リスクとメカニズム
透かし評価

When Experience Becomes Instruction: Trajectory Poisoning in Self-Evolving Agent Skill Systems

Authors: Jialuo Chen, Lingqi Jiang, Xinhao Deng, Xiaohu Du, Jianan Ma, Yunhao Feng, Yuqi Qing, Zhihao Yuan, Linkang Du, Jingyi Wang | Published: 2026-08-06
AIシステムの関係性
攻撃計画手法
研究方法論

PromptShield Home: Ambient Multimodal Prompt Injection Defense for Smart-Home Agents

Authors: He Zhang, Feilong Li, Dingning Long, Yilin Cui, Peijun Zhang, Yuewen Zhang, Qianyao Xu, Xinyi Fu | Published: 2026-08-06
データセットの多様性
プロンプトインジェクション
音声アシスタントの誤作動

Hardware Design and Security in the Era of Chiplets and LLMs

Authors: Johann Knechtel, Ozgur Sinanoglu, Paul V. Gratz, Ramesh Karri | Published: 2026-08-05
LLMとの協力効果
知的財産保護
防御手法

Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning

Authors: Yuxuan Huang, Xingyu Zeng, Tianhang Zheng, Chaochao Lu | Published: 2026-08-05
透かし手法
透かし評価
防御手法

Private Direct Preference Optimization for LLM Alignment

Authors: Yangfan Jiang, Fei Wei, Ergute Bao, Xiaokui Xiao, Yaliang Li, Bolin Ding | Published: 2026-08-05
アライメント
プライバシー保護手法
個別化手法

LLM-Assisted Detection and Repair of Hardware Security Vulnerabilities in Verilog Designs

Authors: Ethen Santana, Gabriel Gyaase, Hao Zheng | Published: 2026-08-05
LLMとの協力効果
プロンプトリーキング
脆弱性予測

When Shared Rollouts Fail in Defensive Driving Evaluation: A NAVSIM Score Basis Audit

Authors: Ziang Wei, Minjun Yu, Zheyuan Lai, Mingjie Pang, Wei Li | Published: 2026-08-05
シミュレーション結果評価
行動分析手法
透かし評価

PURPOSE: Poisoning Conflict Resolution in RAG via Proxy-Fact-Grounded Updates

Authors: Zijian Wang, Yubo Zhu, Muzhi Dong, Yanjun Lou, Yisheng Li, ZiLiang Zhang, Wei Tong, Yuan Zhang, Jingyu Hua, Sheng Zhong | Published: 2026-08-05
RAGへのポイズニング攻撃
攻撃計画手法
防御手法

“Allow” to Achieve, Over-Privileged Inadvertently: The Unintended Cost of Task-Completion-Driven Pop-up Decisions in Mobile GUI Agents

Authors: Dongsheng Chen, Yuxuan Li, Guanhua Chen, Jiaxin Zhang, Xiangyu Zhao, Lei Ma, Xin Yao, Xuetao Wei | Published: 2026-08-05
タスク設計
プロンプトリーキング
リスクとメカニズム