機械学習用「EC2インスタンス」選びの基本【後編】
SageMakerの「予算オーバー」を防ぐには? 賢いインスタンスの選び方
「Amazon SageMaker」でAIワークロードを実行する際、予算オーバーになるのはよくある問題だ。SageMakerのインスタンス選びで、料金を抑えながら性能を最大限に引き出すポイントとは。
機械学習などのAI(人工知能)技術を活用する上で、機械学習モデルのトレーニング、推論といった処理(ワークロード)を実行するには、大量の計算処理能力が欠かせない。これを実現するための手段として、Amazon Web Services(AWS)の機械学習モデル構築サービス「Amazon SageMaker」(以下、SageMaker)がある。
SageMakerのインフラとなるのが、仮想マシンサービス「Amazon Elastic Compute Cloud」(Amazon EC2、以下EC2)だ。インスタンスのCPUコア数、メモリ容量、GPU、ネットワーク帯域幅などの組み合わせを定義したインスタンスタイプの選択は、AIワークロードを効果的に実行したり、SageMakerの費用を削減したりする上で重要になる。どのような点に注意してEC2インスタンスを選べばよいのか。
「どのEC2インスタンスが適切か」を見極めるには?
併せて読みたいお薦め記事
連載:機械学習用「EC2インスタンス」選びの基本
AWSサービス活用のヒント
機械学習を活用したアプリケーションを公開するまでには複数のステップがある。そのライフサイクルを通じてさまざまなタスクをこなすために、さまざまな種類の計算能力が必要になる。機械学習モデルの構築と活用に関連する主なタスクは以下の通りだ。
- モデルの設計と実装
- データの前処理と後処理
- モデル性能の評価
- モデルのトレーニング
- データの準備
- モデルによる推論
ほとんどの場合、これらのタスクごとに計算能力や処理時間、スケーラビリティ(拡張性)などに関する要件、直面する課題が異なる。そのため、実行するタスクに応じて適切なEC2インスタンスを選ぶことが重要だ。適切なインスタンスを選択する際のポイントを以下に挙げる。
ポイント1.要件を分析する
特定のインスタンスタイプやインスタンスサイズ(インスタンスを構成するリソースの規模)を選択する前に、各タスクのパフォーマンスに関する要件を明確にしよう。インスタンスを最適化すると、同等の容量を持つ汎用(はんよう)インスタンスよりも費用が高くなる場合がある。レイテンシや処理、学習、推論に必要なデータ量などに関するビジネス目標を達成するために、その費用が見合うかどうかを検討しなければならない。
汎用のインスタンスタイプでも要件を満たせる場合がある。だが高いパフォーマンスが結果的にコスト削減につながることもある。各タスクについて、想定しているデータ量やトランザクション量に応じて複数のテストを実行し、高いパフォーマンスが有効なのかどうかを評価する必要がある。複数のインスタンスタイプを試しながら費用を計算し、UX(ユーザーエクスペリエンス)やアプリケーションのパフォーマンスに影響するメトリクス(指標)を測定する。
ポイント2.メトリクスを見る
「Amazon CloudWatch」は、AWSサービスにおけるリソースの管理・監視ツールだ。呼び出し回数やレイテンシ、エラー率、CPUとメモリの使用率といったメトリクスを提供する。機械学習タスクは、コストが短期間で数千ドルに達する可能性があるため、要件ごとに最適なインフラコストを把握することが重要だ。Amazon CloudWatchが提供するメトリクスは、特定のインスタンスタイプが特定のワークロードに適しているかどうかを評価するために役立つ。
ポイント3.コストを最適化する
SageMakerの料金モデル「Amazon SageMaker Savings Plans」を利用することで、コストを削減できる可能性がある。1年または3年の契約期間において、ユーザー企業が特定の使用量を約束することで、料金の割引を受けることが可能だ。ただしAmazon SageMaker Savings Plansの適用範囲には制限がある点に注意が必要だ。
TechTarget発 世界のインサイト&ベストプラクティス
米国TechTargetの豊富な記事の中から、さまざまな業種や職種に関する動向やビジネスノウハウなどを厳選してお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
TechTarget発 世界のインサイト&ベストプラクティス
米国TechTargetの豊富な記事の中から、さまざまな業種や職種に関する動向やビジネスノウハウなどを厳選してお届けします。
この記事の著者
関連記事
新着ホワイトペーパー PR
-
技術文書・技術解説
[Jamf Japan 合同会社] MDMだけでモバイルセキュリティは十分? 不足する対策を16項目でチェック -
製品資料
[株式会社ウェーブスプリッタ・ジャパン] 100Gbps対応の光トランシーバーはどう選ぶ? 10分で分かる選定のポイント -
製品資料
[株式会社フィックスターズ] 組み込み開発の生産性と機密性を両立、自社環境で構築する「セキュアAI」活用術 -
製品レビュー
[ServiceNow Japan合同会社] 問い合わせの約9割を自動で解決、AI主導の自律型CRMがもたらす業務変革の全貌 -
市場調査・トレンド
[ServiceNow Japan合同会社] AI活用が業務自動化で止まる理由は何か? 調査で判明した課題と変革への道筋
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
AI全部入り「Microsoft 365 E7」に企業が二の足を踏む訳 移行意向はわずか4%
-
2
なぜOpenAIやAnthropicのAIは「脱走」したのか 情シスが迫られるエージェント統制
-
3
【基本情報技術者試験】「デュプレックスシステム」と「デュアルシステム」の違いは?
-
4
脱VMwareの前提が崩れる BroadcomのVDDK公開停止で確認すべき点
-
5
Anthropicが明かす AIは入力データを「どこまで覚えているのか」
-
6
GitHubが指摘 AIが書いた「おそらく動くコード」が招くシステム崩壊
-
7
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
8
「Microsoft一択」で本当にいいのか 知らぬ間にライセンス費用が膨らむ真相
-
9
ただなのに「12時間以内の復旧」も要求 無償OSSに商用レベルを求める企業の末路
-
10
「にゃんこ大戦争」がAWSを脱出した理由 無停止移行に潜む“わな”
ホワイトペーパーランキング PR
-
1
生成AIのハルシネーションを防止 回答精度を高めるセマンティックレイヤーとは
-
2
5回聞くだけじゃ足りない? トヨタ式「なぜなぜ分析」の正しい実践方法
-
3
AIエージェントで多様な日常業務を効率化するための入門ガイド
-
4
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
5
「脱Excel」か「Excel快適化」か? 現場にやさしい業務改善の進め方
-
6
マンガで解説:「ゼロトラスト」「SASE」の必要性とメリット
-
7
5分で分かる「セキュア大容量ファイル転送サービス」の機能とメリット
-
8
情報セキュリティ対策早分かりガイド:25の自社診断で弱点と解決策を理解
-
9
国税庁の次世代基幹システム「KSK2」稼働開始に向けて、対応すべき変更点とは?
-
10
AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー