AIセキュリティポータルbot

Usability as a Weapon: Attacking the Safety of LLM-Based Code Generation via Usability Requirements

Authors: Yue Li, Xiao Li, Hao Wu, Yue Zhang, Yechao Zhang, Yating Liu, Fengyuan Xu, Sheng Zhong | Published: 2026-05-11
LLMの安全機構の解除
セキュリティとユーザビリティのトレードオフ
攻撃の評価

Sketch-based Access Control: A Multimodal Interface for Translating User Preferences into Intent-Aligned Policies

Authors: Kyzyl Monteiro, Sauvik Das | Published: 2026-05-11
アクセス制御モデル
データプライバシー管理
リスク管理

Probabilistic-bit Guided CDCL for SAT Solving using Ising Consensus Assumptions

Authors: Melki Bino | Published: 2026-05-05
SATソルバー
実験設定
機械学習技術

Generating Proof-of-Vulnerability Tests to Help Enhance the Security of Complex Software

Authors: Shravya Kanchi, Xiaoyan Zang, Ying Zhang, Danfeng Yao, Na Meng | Published: 2026-05-05
プロンプトインジェクション
大規模言語モデル
脆弱性検出手法

KVerus: Scalable and Resilient Formal Verification Proof Generation for Rust Code

Authors: Yuwei Liu, Xinyi Wan, Yanhao Wang, Minghua Wang, Lin Huang, Tao Wei | Published: 2026-05-05
データ整合性制約
堅牢性検証手法
証明生成手法

GPUBreach: Privilege Escalation Attacks on GPUs using Rowhammer

Authors: Chris S. Lin, Yuqin Yan, Guozhen Ding, Joyce Qu, Joseph Zhu, David Lie, Gururaj Saileshwar | Published: 2026-05-05
GPUメモリ管理
メモリ効率化手法
攻撃タイプ

Bandits attack function optimization

Authors: Philippe Preux, Rémi Munos, Michal Valko | Published: 2026-05-05
探索と活用のジレンマ
最適化アルゴリズム
機械学習手法

Exposing LLM Safety Gaps Through Mathematical Encoding:New Attacks and Systematic Analysis

Authors: Haoyu Zhang, Mohammad Zandsalimy, Shanu Sushmita | Published: 2026-05-05
LLMの安全機構の解除
プロンプトインジェクション
研究方法論

ARGUS: Defending LLM Agents Against Context-Aware Prompt Injection

Authors: Shihao Weng, Yang Feng, Jinrui Zhang, Xiaofei Xie, Jiongchi Yu, Jia Liu | Published: 2026-05-05
RAG
インダイレクトプロンプトインジェクション
評価手法

Efficient Preference Poisoning Attack on Offline RLHF

Authors: Chenye Yang, Weiyu Xu, Lifeng Lai | Published: 2026-05-04
アライメント
ポイズニング
ポイズニング攻撃