AI導入で見直すストレージ戦略【後編】
AI処理のボトルネックを解消する「次世代ストレージ」の条件とは?
GPUの性能を最大限引き出すには、それを支えるストレージ側の進化が欠かせない。ストレージに求められている要件と、それを実現するための技術動向を解説する。
AI(人工知能)プロジェクト向けに高性能なGPUを用意しても、データの処理が追い付かなければ成果は出せない。こうした課題に対処すべく、ストレージの進化が加速している。AIインフラのボトルネック解消に向けた技術動向を解説する。
AI処理のボトルネックを解消する「次世代ストレージ」の条件
併せて読みたいお薦め記事
連載:AI導入で見直すストレージ戦略
AI技術の動向を解説
機械学習(ML)では、学習や推論の過程で大量のデータアクセスが同時多発的に発生する。I/O(入出力)待機時間を削減し、全体的な処理性能を大幅に向上させるために、ストレージ側で複数のデータストリームを同時に処理する「並列処理」が活用されている。
例えばGoogleが2023年に発表した「Parallelstore」は、AI用途に特化したマネージド並列ファイルストレージで、高スループットかつスケーラブルなI/O処理を実現できる。
AIワークロードにおけるもう一つの課題が、GPUとストレージキャッシュ間に生じるデータ転送のボトルネックだ。高価で供給も限られるGPUを最大限活用するには、ストレージからGPUへのデータ転送のレイテンシを最小限に抑える必要がある。ストレージベンダーInsurgo Mediaの最高商務責任者ジョン・ウーリー氏は、「GPUのアイドル時間(starvation)を防ぐためには、少なくとも毎秒10GBの持続的なスループットが必要だ」と述べている。
この課題の解決策として、GPUとストレージが直接データをやりとりできる「NVIDIA GPUDirect Storage」がある。GPUが従来のようにCPUやOSを経由せず、転送プロトコル「NVMe」(Non-Volatile Memory Express)を採用したストレージへ直接アクセスでき、RDMA(リモートダイレクトメモリアクセス)に類似したアーキテクチャを採用している。この仕組みはDGS(Direct GPU Support)とも呼ばれ、レイテンシの大幅削減に役立つ。
GPUと共有ストレージ間に、NVMe接続SSDをローカルキャッシュレイヤーとして配置し、各GPUに毎秒60GB超の帯域飽和を供給する構成も登場している。この性能を支えるため、クラウドベンダー各社は「シングルレベルセル」(SLC)のNAND型フラッシュメモリをベースとしたDGS最適化SSDの開発を進めている。
NAND型フラッシュメモリ用コントローラーを手掛けるPhison USの最高技術責任者(CTO)セバスチャン・ジーン氏は、次のように説明する。「推論ワークロードでは、従来型の大容量ストレージと、超低レイテンシのDGS対応ストレージの両方が求められる」。小さなI/Oを瞬時にさばく能力が、GPUベースのAI処理では特に重要だと同氏は指摘する。
こうしたニーズの高まりを受けて、NVIDIAが提供するAIインフラ向けの認証「NVIDIA DGX BasePod」「NVIDIA DGX SuperPod」を取得したストレージ製品も増えている。AIワークロードに特化したストレージは、今後の主力インフラとして、より洗練された設計へと進化していく見込みだ。昨今の代表的なAIワークロード向けストレージには、以下のような製品がある。
- NutanixのAIインフラ基盤「Nutanix Enterprise AI」
- Pure StorageのSTaaS(Storage as a Service)「Evergreen One for AI」
- DellのスケールアウトNAS(ネットワーク接続ストレージ)「Dell PowerScale」
- VAST Dataのストレージ基盤「Vast Data Platform」
- その他、Weka.io、HPE、Hitachi Vantara、IBM、NetAppなどの製品
Computer Weekly発 世界に学ぶIT導入・活用術
米国Informa TechTargetが運営する英国Computer Weeklyの豊富な記事の中から、海外企業のIT製品導入事例や業種別のIT活用トレンドを厳選してお届けします。
Copyright © ITmedia, Inc. All Rights Reserved.
Computer Weekly発 世界に学ぶIT導入・活用術
この記事の著者
関連記事
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
急増する「AIはこう言ってる」マン 判断を狂わせる「AI忖度」を防ぐには?
-
2
取手市がVDIと決別した理由 更改費用「4倍超」を約1.7倍に圧縮
-
3
「データストレージの活用方法」に関するアンケート
-
4
自宅のWi-Fiが「遅い」「途切れる」本当の原因は? Dellが推奨する鉄則
-
5
本当に安いPCで十分か? “すぐ重くなる”を防ぐノートPC選びの絶対条件
-
6
Claudeの不可視透かしに批判殺到 著作権消失や誤判定に潜む企業リスク
-
7
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
8
221人調査で分かった「情シス最大のストレス」は?
-
9
LLMの「過学習」、正しく説明している文章はどれ?
-
10
レガシー基幹システムをSAPに統合 山善が突き止めた「標準化と個別最適」の境界線
ホワイトペーパーランキング PR
-
1
年収2000万「クラウドセキュリティのプロ」になれる資格とは
-
2
セキュリティソフトをすり抜ける標的型攻撃メール、不審メールの見破り方とは?
-
3
Windows Updateの通信集中で回線が逼迫、ネットワーク刷新事例に学ぶ解決策
-
4
財務を戦略的組織へ進化させるAI活用術、4つの主要な障壁と解消方法
-
5
「NAS」「SAN」「DAS」は何が違う? いまさら聞けないストレージの基礎
-
6
“あのファイル転送”で暗躍するノーウェアランサム
-
7
標的型攻撃メールを見破るには? サンプル文面を例に傾向を解説
-
8
商用利用の安全性を確保し大量のコンテンツを高速で生成する、AI活用の秘訣
-
9
マンガで解説、1日で生成AI環境を構築できるワークショップの中身とは?
-
10
Dark AIが台頭する時代の新発想、「より高度なAIで対抗する」具体的方法とは?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー