文献データベース

BenchShield: Formal Model-Backed Instrumentation for Reward Integrity in LLM-Agent Evaluation Infrastructure

Authors: Shenghan Zheng, Zonglin Di, Yimin Liu, Kyoung Whan Choe, Jiankai Sun, Heguang Lin, Penghao Jiang, Yifeng He, Xiao Cheng, Jicheng Wang, Wenbo Chen, Alex Yates, Yinzhe Zhao, Bingran You, Yuan Gao, Ayush Munot, Shubham Gaur, Zhe Ye, Hao Wang, Xiangyi Li, Dawn Song, Christophe Hauser | Published: 2026-09-10
構造的結果
監査トレース
評価手法

DeFiFusion: Combining Transaction Events with Smart Contracts to Detect Price Manipulation Attacks

Authors: Rui Cao, Shaojing Fan, Liming Fang, Yuchan Liu, Yingying Jiao, Zhenguang Liu | Published: 2026-09-10
イベントトレース分析
検出手法の分析
評価手法

Demystifying the Privacy-Utility Trade-off in LLM Interactions

Authors: Zhenhua Liu, Zhanxu Xie, Junjie Yu, Tong Zhu, Lijun Li, Wenliang Chen | Published: 2026-09-10
プライバシーとユーティリティのトレードオフ
ユーザー特性
差分プライバシー

Towards Tackling Application Logic Flaws through Autonomous Formal-Logic Modeling and Automated Reasoning

Authors: Yiwei Fang, Yichen Liu, Ze Jin, Haoqiang Wang, Qixu Liu, Luyi Xing | Published: 2026-09-09
IoTサイバーセキュリティ
ユーザー認証システム
攻撃手法の効果

Towards Scalable and Cost-Efficient Vulnerability Detection: A Study on Automatic Query Generation

Authors: Ivana Clairine Irsan, Ratnadira Widyasari, Huihui Huang, Ting Zhang, Yue Liu, Ouh Eng Lieh, Shar Lwin Khin, Kang Hong Jin, David Lo | Published: 2026-09-09
サイバーセキュリティ
プロンプトインジェクション
脆弱性予測

Learning Intrusion Response Strategies for OT Systems

Authors: Duc Huy Le, Rolf Stadler | Published: 2026-09-09
POMDP問題
攻撃シナリオ
防御戦略

Maverick: Private and Verifiable LLM Inference Made Practical via Matrix-Vector Multiplication Delegation

Authors: Ben Merbaum, Mohammad Amin Raeisi, Wenhao Wang, Charalampos Papamanthou, Katerina Sotiraki, Fan Zhang | Published: 2026-09-09
効率的な構成検証
評価結果
透かし手法

Active Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning

Authors: Jing Guan, Yachao Yang, Zhaoliang Liu, Yuyao Zhang, Fanyu Meng, Junlan Feng | Published: 2026-09-09
プロンプトインジェクション
モデルの堅牢性
適応型敵対的訓練

Understanding the Security Boundary of Obfuscation-based On-Device LLM Protection

Authors: Hanyi Zhou, Chenyang Li, Yuanzhe Pang, Ke Xu, Mingwei Xu, Zhuotao Liu | Published: 2026-09-09
TEEsのセキュリティ
バックドアモデルの検知
透かし手法

Belief-State Engine: Augmenting LLMs for Principled Planning Under Partial Observability

Authors: Arnab Chattopadhayay, Debdipta Halder | Published: 2026-09-09
POMDP問題
ポリシー生成
実験手法