原因特定精度はわずか11%でも……
AIの“自信満々なうそ”にだまされる人間 インシデント調査自動化が抱える闇
人手不足が深刻なIT現場で、システム障害対処を自動化するAIエージェントは救世主のように思えるが、全ての提案をうのみにすることは誤りだ。誤った回答を出し続けるAIエージェントに依存すると何が危険なのか。
システム障害が発生した際、膨大なアラートやログから状況を把握し、原因を特定して復旧する作業は、担当者にとって大きな重圧になる。この初動調査の負担を軽減する仕組みとして、AIエージェントの導入が急拡大している。商用の監視ツールに加え、オープンソースの監視ツールもAIエージェントとの連携が進んでいる。
AIエージェントの優位性は、散在するシステムログやメトリクス(指標)を即座に収集し、相関関係を見つけ出す際の圧倒的な処理速度にある。従来であればエンジニアが複数の画面を行き来する必要があった情報収集と初期分析を自動化し、解決策を提示してくれる。
しかし、この利便性の裏で、現場のエンジニアは思いがけない落とし穴に直面している。与えるデータが不適切であれば、AIエージェントは無関係な情報分析に固執し、かえって調査のノイズになってしまう。真の危機は、AIが「自信満々にうそをつく」こと、人がそれを検証せずに盲信してしまうことだ。
AIの“醜い側面”
併せて読みたいお薦め記事
AIエージェントで障害対処は楽になるのか
AIエージェントが陥る「バッド」(Bad)な側面の筆頭は、文脈の欠如による迷走だ。AIモデルは与えられたデータに基づいて推論するため、ノイズが多いログを読み込ませると、無関係なアラートの深掘りを始めてしまう。近年の大規模言語モデル(LLM)は処理できるコンテキスト長(やりとりの中で保持できる情報量)が増加しているとはいえ、システムが吐き出す膨大なデータを全て処理できるわけではなく、情報を詰め込み過ぎると推論性能が著しく低下する。「ごみを入れればごみが出てくる」という原則の通り、入力するデータの品質を人が管理できなければ、AIエージェントの能力を引き出すことはできない。
ただ、これらは運用上の工夫で回避できる課題に過ぎない。AI技術を活用した自動音声サービスを手掛けるVocaly AIの創業者ブラディスラフ・ブディチェンコ氏が警鐘を鳴らすのは、システムや企業に深刻な打撃を与えかねない「アグリー」(Ugly:醜い)な側面だ。
根本原因の特定精度は11%
1つ目の危険性は、AIエージェントによる根本原因分析の精度の低さと、それに反比例する「自信」だ。Microsoftと清華大学の研究チームが開発したシステム障害の原因究明ベンチマーク「OpenRCA」を用いた検証結果がある。この検証では、実稼働する3つの企業向けソフトウェアシステムから収集された335件の障害データと、約68GBに及ぶ膨大なテレメトリーデータを対象に、大規模言語モデル(LLM)の推論・原因特定能力をテストした。その結果、プログラム実行機能を備えた専用のエージェントを用いた最優秀モデル(Claude 3.5)であっても、障害の発生場所、発生時刻、原因の全てを正確に特定できた割合(完全特定率)は、わずか11%に過ぎなかった。問題は、AIエージェントがこのように低い正答率にもかかわらず、常に100%の自信を持って「もっともらしい」説明を生成することだ。
このAIエージェントの挙動は、2つ目の危険性である「人の過信」を誘発する。AIエージェントが提示するもっともらしい解決策を、エンジニアは十分に検証せずに承認してしまう傾向がある。IBMが調査会社Ponemon Instituteと共同で実施し、2024年3月~2025年2月にデータ侵害を経験した3470人のセキュリティ担当者および経営層への調査によると、AI関連のデータ侵害を経験した企業の97%において、AIエージェントに対するアクセス制御が不十分だったことが明らかになっている。
この過信は、企業の技術力そのものをむしばむ。若手エンジニアはAIエージェントに依存することで、自力で調査するスキルを習得する機会を奪われ、熟練エンジニアも手動調査の能力が衰退する危険性が指摘されている。人を介在させる仕組みを取り入れても、人がただ承認ボタンを押すだけになってしまえば、その意味を成さない。
セキュリティ上の新たな脅威も浮上している。攻撃者がアプリケーションのログに悪意のあるコマンドを仕込み、インシデント調査のためにログを読み込んだAIエージェントにそのコマンドを実行させる「プロンプトインジェクション」攻撃が登場している。AIエージェントに自律的な修復権限を与えている場合、意図せず機密情報を漏えいさせたり、システムを破壊したりする恐れがある。
人とAIの適切な分担
これらのリスクを踏まえ、インシデント対処におけるAI活用はどうあるべきか。ブディチェンコ氏は、AI技術を「力の乗数」として位置付けることを推奨する。ツールの壁を越えたデータの相関分析や既知のパターンの認識、初期対処の高速化といった領域では、AIエージェントの能力を最大限に引き出すことが可能になる。
一方で、システムの高リスクな変更や未知の複雑なインシデント対処など、最終的な意思決定と自律的な実行は人間が担う必要がある。AIエージェントが提示する結果は必ず検証するという原則を組織内で徹底し、人とAIエージェントの適切な協調体制を築くことが、次世代のインシデント対処を成功させる鍵になる。
本稿は、USENIXが2026年4月24日に公開した動画「SREcon26 Americas - AI Agents for Incident Investigation: The Good, The Bad, and The Ugly」を基に作成しました。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
関連記事
新着ホワイトペーパー PR
-
技術文書・技術解説
[アトラシアン株式会社] IT運用や従業員サポートは生成AIでどう変わる? 使い方や導入の流れは? -
製品資料
[株式会社みらい翻訳] 音声翻訳活用の課題を解決、“本当に使える”ツールの特徴とは? -
製品レビュー
[Wrike Japan 株式会社] 400店舗を支えるWalmart Canada、散在する情報やアナログな管理をどう変えた? -
事例
[Wrike Japan 株式会社] 年間100件超のDXプロジェクトを統合管理、JERAはどのように実現した? -
事例
[Wrike Japan 株式会社] グローバルなクリエイティブ業務を合理化、エスティーローダーに学ぶ実践のコツ
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
全社標準Copilotに絶望? MS Copilotで問い合わせ6割減できた企業は何が違った
-
2
身代金支払いは逆効果 情シスのためのランサムウェア対策ガイド2026
-
3
自社を守る「SCS評価制度」活用法 7割の企業が取引先起点の情報漏えいに直面
-
4
ランサムウェア、暗号化の89%は深夜 情シスが備える「夜間の空白」対策
-
5
多要素認証導入済みでもランサムウェア被害に 復旧費用は平均2億7000万円
-
6
「技術屋」で終わるか、部長へ昇格するか 今取りたい「IT×ビジネスの認定資格」5選
-
7
「Copilot」はなぜ放置される? “議事録要約止まり”を脱する処方箋
-
8
脱VMwareの前提が崩れる BroadcomのVDDK公開停止で確認すべき点
-
9
「AI活用を前提とした業務PCへの移行」に関するアンケート
-
10
AIエージェントを暴走させない設定、済んでますか? 対策5選を専門家が紹介
ホワイトペーパーランキング PR
-
1
5回聞くだけじゃ足りない? トヨタ式「なぜなぜ分析」の正しい実践方法
-
2
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
3
生成AIで文書活用を進めるには? 効率化と安全性をどう両立する
-
4
Windows PCとMacの選択制で生産性向上 LINEヤフーが実践する運用管理方法とは
-
5
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
6
国税庁の次世代基幹システム「KSK2」稼働開始に向けて、対応すべき変更点とは?
-
7
「スクラム」と「カンバン」の違いとは? アジャイル型開発手法を徹底比較
-
8
AI時代に成功するための「ナレッジマネジメント」ベストプラクティス
-
9
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
10
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー