AIセキュリティポータルbot

MMJailBench: A Factorized Benchmark for Disentangling Multimodal Jailbreak Vulnerabilities

Authors: Tianshi Wang, Jingsong Wang, Yafei Huang, Fengling Li, Xin Li, Lei Zhu | Published: 2026-08-26
Large Language Model
Vulnerability Assessment Method
視覚的セマンティクス

MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration

Authors: Miseon Yu, Jaehoon Choi, Younghan Lee, Yunheung Paek | Published: 2026-08-26
System Development
セキュリティ考慮
Prompt Injection

Distance Is Not Enough: Forget-Retain Alignment Gap Predicts LLM Relearning Robustness

Authors: Yi Chen, Hanna Hsieh, Shuhong Liu, Chuanbo Hua, Zihan Ma, Kun Wang, Joo-Young Kim | Published: 2026-08-26
Model Robustness
Robustness of Deep Networks
Knowledge Distillation

Refusal geometry reflects refusal training: diverse refusal prefixes can raise stable rank and weaken refusal vector ablation attacks

Authors: Andrey Labunets | Published: 2026-08-26
Poisoning
Model Robustness
攻撃戦略分析

FinRiskAtlas: Decision-Aligned Evaluation of Large Language Models for Financial Risk Review

Authors: Suyang Zhong, Jingzhe Zhu, Qi Xu, Liyao Sun, Yin Wang, Qingqing Sun, Shuai Chen, Tianyi Zhang | Published: 2026-08-26
Dataset Applicability
Machine Learning Application
State Transition Model

LLMscope: Extracting LLM Assets from Edge AI Chips via Optical Probing

Authors: Dev Mehta, Lily Dukette, William Folan, Olivia Kochol, Noah Solomon, Shahin Tajik, Fatemeh Ganji | Published: 2026-08-26
Indirect Prompt Injection
Testbed
資産識別

Combining Self-Embedding Audio Watermarking with Ultra-Low-Bitrate Neural Codecs

Authors: Yigitcan Özer, Xin Wang, Zhe Zhang, Junichi Yamagishi | Published: 2026-08-26
Signal Analysis
Self-Evolving Framework
Defense Mechanism

A Training-Free Proactive Defense Against Partial Speech Manipulation via Self-Embedding Steganography

Authors: Yigitcan Özer, Zhe Zhang, Wanying Ge, Xin Wang, Junichi Yamagishi | Published: 2026-08-26
Signal Analysis
Defense Mechanism
音声透かし技術

Prompt Structure Redistributes, Not Reduces: An Empirical Analysis of Security-Weaknesses in LLM-Generated Python Code

Authors: Maitreyee Das Urmi, Jessica Pourleyli, Fabio Santos, Glaucia Melo | Published: 2026-08-25
セキュリティ考慮
Prompt Injection
Prompt leaking

Right Diagnoses, Decorative Reasoning:A Perturbation Audit of Medical Chain-of-Thought

Authors: Mengzhu Xu, Jifan Gao, Xia Jiang, Yaoxin Wu, Xi Long | Published: 2026-08-25
Reliability Scoring
Watermarking Settings for Medical Data
Research Methodology