AIに欠かせないSSD【後編】
AI推論の遅延解消を目指す「SSDの魔改造」「GPUのNAND化」とは?
GPUへのデータ供給の遅れが、AI推論のボトルネックになっている。この課題に対し、SSD自体を推論処理に特化させるアプローチや、GPUのメモリ構造を変えるアプローチが登場している。その詳細を解説する。
AI(人工知能)技術の進化に伴い、大容量SSDも進化を遂げている。SSDは学習データを保管する以外にも有望なAI技術関連の用途がある。それは、AIモデルが判断を下す「推論」処理の高速化だ。NAND型フラッシュメモリベンダーのSamsung ElectronicsとSK hynixは、オンプレミスデータセンターにおけるAIモデルの推論処理が、大容量SSDのもう一つの大きな需要要因だと指摘している。
リアルタイム推論を「大容量SSD」で実現する2つのアプローチ
併せて読みたいお薦め記事
連載:AIに欠かせないSSD
AIシステムのためのストレージ
一部のオンプレミスデータセンターは、クラウドサービスに預けることができない機密データを扱っている。これらのデータセンターでは、AIモデルの学習データや推論データも他のデータと同様のセキュリティレベルで保護しなければならない。さまざまな国の政府が、AI関連のデータ主権(自国のデータは自国内の法律の下で管理するという考え方)を守るために、国内にAIデータセンターを建設している。このことを考えれば、個々の企業や組織が同様の対策を講じるのは自然な流れだ。
AIモデルの推論は、学習済みのAIモデルを使い、新しいデータに基づいて予測や判断をする処理だ。リアルタイム性が求められる推論が必要な場合、クラウドサービスのAIモデルを用いると、データの転送と応答に時間がかかり、タイムロスが発生してしまう。これを回避するためには、データをクラウドサービスに送らず、オンプレミスデータセンターで処理することが重要になる。
オンプレミスデータセンターで推論を素早く実行するには、AIモデルを瞬時に読み出さなければならない。こうした読み込みはHDDでは追い付かず、より高速に読み書きが可能なSSDが必要になる。数十TBのAIモデルのように、大きなサイズのAIモデルで推論を実行する場合、その巨大なデータを格納するための大容量SSDも必要になるという考え方だ。
SSDとGPUの最適化
AIモデルが実行する処理では、GPU(グラフィックス処理装置)の計算能力にストレージからのデータ供給が追い付かず、GPUがデータを待つための「待機時間」が発生する。この無駄な待機時間をいかに減らすかが、AIシステム全体の性能を向上させる上で重要だ。こうした課題を解決するため、ベンダーはSSDの性能、特に応答速度(レイテンシ)やランダムアクセス性能を、GPUがデータを要求するパターンに最適化させる方法を模索している。
その一つが、NAND型フラッシュメモリ技術ベンダーPhison Electronicが提供する「aiDAPTIV+」だ。これはソフトウェアとハードウェアを組み合わせた製品で、AI関連処理に特化したSSDを使用することで、必要なGPUの数を削減する。aiDAPTIV+は、AI関連処理を実行する上での固有の要件を満たす2つの要素で構成されている。1つ目は高い耐久性を備える専用SSD、2つ目は適切なタイミングでSSDとGPUでデータを入れ替える専用ミドルウェアだ。
一方、Sandisk(2025年2月にWestern Digitalからフラッシュストレージ事業が分社化)は異なるアプローチを取っている。SSDではなく、GPUが通常搭載するHBM(広帯域メモリ)の一部または全てを置き換える、特別に設計したNAND型フラッシュメモリチップ「HBF」(高帯域幅フラッシュ)の開発を進めている。通常のNAND型フラッシュメモリチップは、容量当たりの価格が最も安くなるように設計される。HBFはそうしたチップを土台にして、複数の独立したチップが並列でデータを読み書きできるようにする技術だ。これによって、読み出しの応答速度や、書き込み前に一度データを消去する必要があるというNAND型フラッシュメモリ固有の制約は残るものの、チップ全体の帯域幅(通信路容量)を飛躍的に向上させることができる。
HBFの業界標準化に向けて、SandiskとSK hynixが協業しているという事実は、この技術がAI分野における特定の問題を解決する上で、業界全体からの期待が集まっていることを示している。推論処理は学習処理に比べてメモリへの書き込みが大幅に少ないため、特に推論システムにおいて、HBFが有効な選択肢になる可能性がある。
上述した「GPU内のメモリをNAND型フラッシュメモリチップで置き換える」アプローチは、必ずしも大容量SSDとセットで導入されるものではない。ただし、HBFを採用したシステムに大容量SSDを追加すれば、お互いの長所を補完し、より高性能なシステムを構築できるようになるといったメリットは見込める。SSDを改良するか、GPU内のメモリを改良するか、どちらのアプローチが主流になるにせよ、大規模AIシステムにおけるNAND型フラッシュメモリベースのストレージの容量は、今後さらに速いペースで増加していくことは明らかだ。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
TechTarget グローバルインサイト
米国Informa TechTargetが発信する記事を翻訳し、国内向けに分かりやすく紹介します。最新の海外動向や先進事例を取り上げ、グローバルなITトレンドを把握できる連載です。
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社キーエンス] なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは -
製品資料
[株式会社セールスフォース・ジャパン] 「CRMは設計と無関係」は本当か? PLMとの融合で実現する高速開発 -
事例
[日本ヒューレット・パッカード合同会社] AIエージェントの時代にどう備える? 「新たな働き手」を支える3要素とは -
製品資料
[日本ヒューレット・パッカード合同会社] “横並びの自動化”から脱却、AI活用で生産性と競争力を高める秘訣 -
製品資料
[サイボウズ株式会社] AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
2
法務と開発者で「言葉が通じない」問題 トヨタやソニーが語るOSS管理の真実
-
3
ChatGPTは“検索しまくり”でGeminiは“淡泊”? データが明かすAIの裏側
-
4
なぜ「Gemini 4 Argon」は出遅れたのか? Googleが狙う“逆転のシナリオ”
-
5
「中堅・中小企業のネットワーク・セキュリティ運用実態」に関するアンケート
-
6
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
7
「Wi-Fi 7」経由でWindowsが乗っ取られる? 最高権限奪取の恐怖
-
8
情報漏えいはなぜ繰り返されるのか 今すぐ見直すべき「境界」
-
9
情シスの約8割が転職や退職を意識 調査で分かった“辞めたくなる最大の理由”
-
10
【漫画付き】ひとり情シス協会が明かす、RAG導入でしくじる企業「2つの共通点」
ホワイトペーパーランキング PR
-
1
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
2
家庭用Wi-Fiルーターの業務利用は危険? 避けるべき理由と具体的な対策
-
3
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
-
4
財務部門がAIを最大限に活用する方法 無駄のない戦略的リーダーシップへの道
-
5
LLMが兵器化? 元FBI高官が鳴らす警鐘とセキュリティツール統合のポイント
-
6
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
7
なぜRPA導入は頓挫する? シナリオ作成の壁を乗り越える解決策とは
-
8
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
9
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
10
HDDを使わない「SSDオンリー」が無謀なのはなぜ?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー