解説記事

人間とAIエージェントの意思決定に関する脅威

はじめにAI技術の発展に伴い、人間に変わって特定のタスクを自律的に行うAIエージェントを用いたシステム(AIエージェントシステム)の利活用が期待されています。大規模言語モデル(Large Language Model, LLM)を中核に、C...

LLMに対するポイズニング攻撃

はじめに大規模言語モデル(Large Language Model、LLM)は、その急速な進化に伴い、教育、医療、法務、金融などさまざまな分野での利活用が拡大しています。しかし、従来のAI技術と同様に、LLMの性能は、学習データの信頼性に依...

AIは“だまし絵”に弱い?敵対的サンプルとその対策:敵対的学習

はじめに最近、「AI(人工知能)」という言葉をよく耳にするようになりました。AIは私たちの生活のさまざまな場面で使われていますが、実はちょっとした“だまし絵”に引っかかってしまうことがあります。たとえば、AIが道路標識を見分けるとき、「一時...

AIはだまされることがある?~AIに仕掛けられるワナとその守り方~

はじめに今や、AI(人工知能)は私たちの生活のあちこちで使われています。たとえば、スマートフォンの顔認証や自動運転の自動車、オンラインストアでの商品のおすすめ表示などもそうです。でも、そんな便利なAIも「だまされてしまう」ことがあるのをご存...

AIの判断根拠がわかる?説明可能なAI

はじめにいまやAI(人工知能)は、スマートフォンの顔認証やネットショッピングのおすすめ機能など、私たちの暮らしのさまざまなところで使われています。でも、「どうしてAIはこんな判断をしたの?」と疑問に思うことはありませんか?この記事では、「A...

説明可能なAI

はじめに本記事では、AIがどのように予測を行ったかを説明する技術である「説明可能AI(XAI)」について解説します。本記事を読むことで、XAIの概要や研究の最新動向、課題、今後の方向性について理解を深めることができます。説明可能AI(XAI...

LLMによる有害な応答を防ぐ、安全機構

はじめに本記事は、大規模言語モデル(Large Language Model、LLM)の安全機構について解説します。LLMはChatGPTなどのような生成AIサービスに利用されており、膨大な知識を有していますが、中には有害な内容も学習してい...

AIを不正に操る、バックドア攻撃

はじめに本記事は、AIに対するポイズニング攻撃の一種であるバックドア攻撃について解説します。特に、あるデータに対してラベルの予測を行う分類モデルに対するバックドア攻撃について整理しています。本記事を読むことで、分類モデルに対するバックドア攻...

あなたは騙されない?ディープフェイクがもたらす偽情報とその対策

はじめに本記事は、ディープフェイクについて解説します。本記事を読むことで、ディープフェイクの原理やそのディープフェイクにより生成された偽コンテンツの検知について理解を深めることができます。※このテーマに関するより専門的な技術解説についてご興...

敵対的サンプルから守る、敵対的学習

はじめに敵対的サンプルとは、AIに誤った出力を引き起こすよう細工された入力データのことです。例えば、標識を認識する画像認識AIに対して、「一時停止」の標識を正しく認識するのを妨げるために、わずかなノイズを加えた画像が挙げられます。こうした画...