テスト駆動開発はもう通用しない?
週800億トークンを処理する大手銀行 AI活用をPoCで終わらせない「3つの柱」
生成AIのPoCが、想定外の費用増や予測不能な挙動によって本番環境に移行できず、頓挫するケースが散見される。膨大なAI処理を安全に運用する豪大手銀行が、実用化の壁を打ち破った「3つのシステム」とは。
組織は生成AIを活用した業務効率化に取り組んでいるものの、実証実験(PoC)にとどまり、本番環境への移行に苦戦しているのが実情だ。入力に対する出力が予測不能であることや、想定外の費用増加、悪意のある入力に対する安全性の確保が困難なことが主な要因だ。
先進的なAI活用組織として知られるオーストラリアの大手商業銀行Commonwealth Bank of Australia(CBA)は、これらの障壁を乗り越え、全社規模での生成AI運用体制を確立した。顧客対応の仮想アシスタントや開発者向けのソースコード生成支援など、多岐にわたる用途で生成AIを活用している。特に同行の生成AIプラットフォームチームが管理するゲートウェイは、開発者のエンジニアリング支援の用途だけでも、1週間で800億トークンという膨大な処理を安定してこなしている。
CBAはいかにして生成AI特有の不確実性を排除し、安全かつ費用対効果の高い運用を実現したのか。次世代のエンジニアに求められる新たなスキルと、本番稼働の壁を破る「3つのシステム」を解説する。
本番稼働を支える3つの要素
併せて読みたいお薦め記事
なぜ本番環境でのAI活用が進まないのか
本記事は、ITエンジニア向け技術カンファレンス「YOW! Brisbane 2025」におけるセッション「Mission-Critical Generative AI in Action: Delivering Safety, Reliability, and Customer Value」の内容を基に構成している。登壇者は、CBAで生成AIシステム開発を率いる生成AIプラットフォームクルーリードのスコット・ショー氏だ。
ショー氏は、生成AIを安全に本番稼働させるための仕組みとして、以下の3つの要素で構成される最小限のシステム構成の導入を主導した。
- ゲートウェイ
- 通信を中継、管理するシステム
- ガードレール
- 不適切な入出力を防ぐ安全装置
- 評価システム
- AIモデルの性能を定量的に測定する仕組み
1.一元管理と負荷分散を実現する「ゲートウェイ」
CBAは、全ての行内の生成AI利用リクエストを、単一の窓口であるゲートウェイを経由させる構成を取っている。これによって、管理部門は利用状況を完全に可視化し、監査に必要な記録を保持できる。ベンダーの処理能力上限によるシステム停止を防ぐため、ゲートウェイが複数の通信を適切に振り分け、負荷を分散(ロードバランシング)させる。
利用中の生成AIサービスが終了したり仕様変更されたりしても、ゲートウェイの設定を変更するだけで、新しいAIモデルにすぐ切り替えられる拡張性を備えている。ショー氏によれば、「GPT-4o」のような主要AIモデルであっても、わずか1年程度で廃止がスケジュールされる傾向にあり、AIモデルの迅速な切り替え能力は本番運用に不可欠だ。
2.規制に適合する「ガードレール」
ガードレールは、システムの入出力を監視し、悪意のある指示の挿入(プロンプトインジェクション)や誤った回答を防ぐ仕組みとして機能する。
CBAは、金融業界の厳格な規制に対処するため、言葉の品質や情報の関連性、事実確認(ファクトチェック)など、12種類の独自の監視基準を定めており、これらを行内の全プロジェクトに必須の仕組みとして一律に適用している。ただし業務ごとに許容される回答の範囲は異なるため、開発者が要件に合わせて基準を微調整できる、自由度の高い構造を採用している。
3.評価主導開発を実現する「評価システム」
CBA独自の工夫として最も重要なのが、評価システムを用いた開発手法の転換だ。従来のソフトウェア開発は「同じ入力に対して常に同じ出力が得られるかどうか」を確認する決定論的なテストが主流だったが、出力が毎回異なる(非決定論的な)生成AIには適さない。そこでCBAは、大量の合成データを用いて生成AIの振る舞いを統計的に測定する「評価主導開発」に移行した。
ショー氏は「いきなり高性能なAIモデルを使うのではなく、まずは評価基準を定め、要件を満たす安価な小規模モデルから始めるべきだ」と指摘する。高性能なAIモデルは非常に優れた性能を持つものの、費用や利用枠の観点から常に最適とは限らない。明確な統計的評価基準をあらかじめ定めておくことで、過剰な性能に頼らなくても、費用を抑えながら安全に本番稼働へと進めることが可能になる。AIモデルの性能不足や過負荷が発生した場合でも、蓄積した評価データを用いて即座に別のAIモデルを検証できる。
次世代エンジニアに求められる要件
生成AIを活用したシステム開発において、エンジニアの役割は大きく変わる。入力と出力の因果関係を論理で記述する従来のアプローチに加え、統計的な分布に基づいてシステムの妥当性を判断する手法が不可欠だ。本番環境で収集したデータを開発環境に還元し、改善サイクルを回し続ける必要がある。
ショー氏は今後のエンジニアに必要な要素として、モデルのトラッキングと評価の厳格さ、安全性に対するリスク意識、確率・統計などの数学的リテラシーを挙げる。
「現場から生まれた熱意あるアイデアを、確率や統計に基づく客観的な評価の枠組みで制御することこそが、生成AIを安全に拡大させるための鍵だ。生成AIシステムは稼働後も常に監視し続ける必要があり、現時点では人間が関与して安全性を確保することが欠かせない」(同氏)
本稿は、Triforkが2026年6月16日に公開した動画「Mission-Critical Generative AI in Action・Scott Shaw・YOW! 2025」を基に作成しました。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣 -
製品資料
[サイボウズ株式会社] AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
【漫画付き】ひとり情シス協会が明かす、RAG導入でしくじる企業「2つの共通点」
-
4
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
5
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
6
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
7
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
8
BMWも導入 78兆円市場に化ける「フィジカルAI」の衝撃
-
9
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
10
「AI活用を前提とした業務PCへの移行」に関するアンケート
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー