AIセキュリティポータルbot

TokenCast: Forecasting Token Consumption During LLM Agent Execution

Authors: Chaoqian Ouyang, Ling Yue, Libin Zheng, Huanghui Guo, Shengxiang Xu, YiShu Wang, Ran Li, Jian Yin, Shaowu Pan, Shimin Di | Published: 2026-09-28
Data Generation
Model DoS
Watermarking Technology

Distillation Defenses Easily Break After Reinforcement Learning

Authors: Shidan Javaheri, Alexander Panfilov, Oliver Britton, Yarin Gal, Yonatan Gideoni | Published: 2026-09-28
Certified Robustness
Reinforcement Learning
Adversarial Learning

Share-Borne AI Virus: Memory-Hopping Attacks Across LLM Agents

Authors: Sidharth Pulipaka, Ansh Sharma, Stanislau Hlebik, Leonidas Raghav, Vyas Raina, Ivaxi Sheth, Mario Fritz | Published: 2026-09-28
Relationship of AI Systems
攻撃戦略分析
透かし攻撃

Let the Neurons Die: Exploiting ReLU-Induced Model Degradation

Authors: Kexin Li, Wenjun Qiu, Joshua Abraham, Aditi Maheshwari, David Lie | Published: 2026-09-28
Data Generation
Model Design
攻撃効果の評価

LLM-Assisted Automatic Security Proofs for Cryptographic Protocols: How Far Are We?

Authors: Tianjian Liu, Shicheng Feng, Jin'ao Shang, Xiaoting Lyu, Bin Wang, Zonghua Zhang, Lei Xue, Wei Wang | Published: 2026-09-28
Model Extraction Attack
Encryption Protocol
脆弱性評価

“Nothing to See Here”: Unintended Disclosure through Revision Traces of LLM Deliverables

Authors: Yage Zhang, Yukun Jiang, Yang Zhang | Published: 2026-09-28
Safety of Data Generation
Information Extraction
Watermark Design

Continuous Assurance of Agentic Security Auditors for Software Delivery Decision Gates

Authors: Guy Lupo, Nguyen Hung Nguyen, Viet Vo, M. A. P. Chamikara, Guangdong Bai, Nazatul Haque Sultan, Alsharif Abuadbba | Published: 2026-09-28
Relationship of AI Systems
セキュリティプロファイリング
監査ログ分析

Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models

Authors: Qiankun Li, Yuechen Zhang, Bowen Chen, Shilinlu Yan, Zhenhong Zhou, Kun Wang, Li Sun | Published: 2026-09-28
攻撃効果の評価
透かし手法
Watermarking Technology

Before Acting, Change the State: Prospective State Intervention for Web Agents under Deceptive Interfaces

Authors: Ruozhao Yang, Mingfei Cheng, Xiaofei Xie | Published: 2026-09-28
Dynamic Policies and Access Control
Watermarking Technology
Defense Effectiveness Analysis

JevVibe: Efficient Classification-Guided Secure Code Generation

Authors: Arshak Rezvani, Sasha Behrouzi, Ahmad-Reza Sadeghi | Published: 2026-09-28
コード脆弱性修復
Generative Model
脆弱性評価