「バグの優先順位」を決めない修正方法
AIコーディングで手間が増える――GoogleのSREが語る自動化の皮肉と生存戦略
生成AIの台頭でソフトウェア開発は容易になったが、システム全体の複雑性は増大し、運用は困難を極めている。Googleエンジニアディレクターが提唱する、ブラックボックス化したシステムに立ち向かう手法を解説する。
「これは決して起こらないはず」。システム開発において、このような前提で記述されたソースコードが、後に想定外の障害を引き起こす要因になるケースがある。Googleのエンジニアディレクターで、同社サービスのSRE(サイト信頼性エンジニア)を務めるミシェル・ブラッシュ氏は、これを「ソースコードの中で最も恐ろしいものだ」と語る。
システム要件や当時の前提に基づく「起こり得ない」という思い込みは、後の変更で容易に崩れ去る。前提が崩れたとき、システム全体がどう反応するかは予測不能だ。
近年、LLM(大規模言語モデル)などの生成AIの普及によって、誰もが迅速にアプリケーションを構築し、ソースコードをリファクタリングできるようになった。開発が容易になることでソフトウェアの総量が爆発的に増加し、システム全体がかえって複雑になる「ジェボンズのパラドックス」が起きようとしている。
このような状況では、企業のIT担当者は全体像を把握し切れないブラックボックス化されたシステムに対面しなければならない。“予測不能なカオス”と化すシステムで、IT担当者はどのようにして信頼性を確保すべきなのか。
自動化が進むと人間の仕事はより面倒になる
本稿は、サイト信頼性エンジニアリングのイベント「SREcon26 Americas」におけるブラッシュ氏のセッション「Taming the Unpredictable: Reliability in Chaos」の内容に基づいて、AI時代の新たなシステム運用手法を解説する。
AIエージェントの導入が進むと、日常的なコーディングや運用作業の大半が自動化される。しかし、「自動化の皮肉」という概念が示す通り、人間の仕事は決して楽にはならない。ルール化できない高度な判断や自動化システム自体の監視、失敗時の修正といった、より複雑なタスクが人間に残されるからだ。
ブラッシュ氏は、「システムがダウンした際に駆け付け、復旧させるのは依然として人間の役割だ」と指摘する。AIモデルは「なぜその答えを出したか説明できない『無意識的有能』な存在」になり得る一方、人間は「自分が何を知らないかを理解できる存在」だ。複雑な境界線上で起きる問題を解決し、AIエージェントがカバーし切れない領域を直感と経験で補うためには、これまで以上にスキルの高いエンジニアの存在が不可欠だ。
バグの優先順位付けを捨て、AIエージェントで継続的に修復する
システムが巨大化し、無数のAIエージェントがソースコードを生成するようになると、小さなミスが積み重なり、思いがけない障害を引き起こす「カオス」の状態に陥る。従来の人間によるコードレビューや、事後の根本原因分析だけでは、とても変化のスピードに追い付けない。
そこでブラッシュ氏が提唱するのが、優先順位付けに基づくバグ修正からの脱却だ。従来の開発現場は「バグバックログ」(発見されたものの未修正のまま蓄積された不具合リスト)を抱え、限られた人員で「どのバグを直すべきか」を評価することに多大な手間をかけていた。
ここでAIエージェントを利用すれば、ソースコード全体から「リトライ処理がない」「エラー処理が不適切」といった特定のアンチパターンを瞬時に見つけ出し、自動的に修正やテストの追加を実行できる。バグの重要度を議論する時間を省き、リスクになり得る箇所をAIエージェントに片っ端から修正させることで、システムの信頼性を底上げする。ブラッシュ氏は「バグバックログを管理しない世界」を理想形として掲げる。
「適応度関数」によるフィードバックループの構築
予測不能なシステムを制御するには、詳細な運用手順書に頼るのではなく、実験と学習に基づくアプローチが必要になる。その中核となるのが「アーキテクチャの適応度関数(フィットネス関数)」だ。
これは、システムが常に満たすべき要件を定義し、それを継続的に自動テストする仕組みだ。ブラッシュ氏が管轄するGoogleの仮想マシン(VM)サービス「Compute Engine」では、「クラスタを任意に追加/削除しても、システム全体に影響を与えない」という要件がある。これを保証するため、背後で常にクラスタの作成と削除を繰り返す自動化プロセスを走らせている。誰かがこの要件を破る変更を加えた瞬間、即座に検出できる仕組みが整っている。
ある消費者向けデバイスベンダーは、「エンドユーザーの操作中にクラッシュしない」という要件を満たすため、画面のピクセルをランダムにタッチし続ける「ホッパー」と呼ばれるテスト装置を活用していた。これによって、人間が想定しない奇妙なバグをデプロイ前に発見できたという。
このアプローチは、トラブル時の「汎用(はんよう)的な緩和策」にも応用できる。再起動や過去のバージョンへのロールバックといった一時的な復旧手段をシステム要件として組み込み、日常的にテストしておくことで、いざというときに確実に機能させることができる。
AIエージェントの登場によって、ソフトウェアの構築プロセスは根本から変わりつつある。それに伴ってIT担当者の役割も、個別のソースコードを理解して修正する現場の作業から、システム全体を俯瞰(ふかん)して変化に耐え得るフィードバックループや安全装置を設計する「アーキテクト」にシフトしている。ブラッシュ氏は「SREにとって、今はかつてないほどエキサイティングな時代だ」と締めくくった。
本稿は、USENIXが2026年4月28日に公開した動画「SREcon26 Americas - Taming the Unpredictable: Reliability in Chaos」を基に作成しました。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
関連記事
新着ホワイトペーパー PR
-
製品レビュー
[ヴィーム・ソフトウェア株式会社] SCS評価制度を導入するだけで十分? 組織の防御力を高める活用方法とは -
技術文書・技術解説
[フォーティネットジャパン合同会社] AIランサムウェアに勝つ 自律型エンドポイント管理導入で確認すべき条件4つ -
技術文書・技術解説
[フォーティネットジャパン合同会社] LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント -
製品レビュー
[ネットアップ合同会社] 研究分野でAI活用が進まない? 真の成果につなげるデータ管理の在り方とは -
製品レビュー
[ヴィーム・ソフトウェア株式会社] SCS評価制度を導入するだけで十分? 組織の防御力を高める活用方法とは
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
2
デンソークリエイト、Excelからの移行も簡単に行えるプロジェクト管理ツールを発表
-
3
VMware離れの決め手は“機能”以外だった 情シス109人が選んだ新基準と死角は
-
4
IBM iのブラックボックス化を打破 資産継承と進化を実現する「IBM Bob」の実力
-
5
二極化する生成AI活用 「一部の社員しか使いこなせない」をどう解消すべきか
-
6
「Apple Watch」、読者の95%は「仕事で使える」、5%は何に不満?
-
7
「クラウドDR」4大基礎用語 クラウドバックアップやDRaaSとの違いは?
-
8
Claude Opus 5.5、GPT-6 Sol/Luna登場 情シスが迫られるモデル使い分け
-
9
高機能化が進む“タブレット型電子カルテ”は次の段階へ
-
10
なぜ情シスは評価されにくい? 読者調査で見えた「成果が見えない仕事」第1位は
ホワイトペーパーランキング PR
-
1
登録セキスぺが語る「SCS評価制度」の舞台裏 星を取得すべき理由と対応のコツ
-
2
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
3
OSSでは困難 100超のサービスを持つマネーフォワードが実践した統合監視術
-
4
「改正物流効率化法対策」徹底解説 総物流費を抑制するサプライチェーン戦略
-
5
月1000枚の紙を削減 9年動けなかった組織が、業務改革のその先に得たもの
-
6
ネットワーク遅延の原因、「パケットロス」の基礎知識と効果的な解決策
-
7
ドラマで分かる、標的型攻撃メールの被害を受ける企業と回避できる企業の分岐点
-
8
Windows PCとMacの選択制で生産性向上 LINEヤフーが実践する運用管理方法とは
-
9
「Google Workspace」活用事例34選、先進の生成AIによる組織変革の全貌
-
10
ソフトウェア開発の属人化と手戻りをどう防ぐ? 速さと品質を両立させる方法
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー