サーバ仮想化はターゲット外
アナリティクス&ビッグデータに最適な新世代フラッシュストレージ
フラッシュ市場の成熟とともに、アナリティクスやビッグデータ用途に最適なフラッシュストレージが登場してきた。従来製品との違いと各社の新世代製品の特徴を紹介する。
フラッシュストレージ市場の当初の目標は、企業のアプリケーションのパフォーマンス問題に対処することだった。最初のフラッシュストレージはそのコストから、高いスループットと低レイテンシによって確実にメリットが得られるアプリケーションのみをターゲットにしていた。
Computer Weekly日本語版 1月11日号無料ダウンロード
本記事は、プレミアムコンテンツ「Computer Weekly日本語版 1月11日号」(PDF)掲載記事の抄訳版です。本記事の全文は、同プレミアムコンテンツで読むことができます。
なお、同コンテンツのEPUB版およびKindle(MOBI)版も提供しています。
だが、市場が成熟し、フラッシュが主流となった今、具体的な要件に対処する新しい種類の製品が登場してきた。その1つが、ビッグデータと分析ワークロードにフラッシュを使用する製品だ。
主要市場が注目するのはパフォーマンスを機能で補完する手法だ。フラッシュ製品の新しい動きは2つの分野に分かれている。
ハイエンド市場では、EMC(DSSD)やMangstor(NXシリーズ)などのサプライヤーが、余分な機能がなく、パフォーマンスが極めて高く、レイテンシが低い製品を提供している。一方、ローエンド市場では、最近のNAND容量の増加を利用する「安価で大容量」のフラッシュ製品が見受けられるようになっている。
SanDiskやPure StorageなどのサプライヤーはTLCや3D NANDテクノロジーにより、フラッシュの耐久性をあまり重視せず、容量やパフォーマンスの要件に応える製品を提供できるようになった。
このような新しいプラットフォームは、サーバ仮想化など従来のワークロードでも使用可能だが、このような使い方はターゲットにしていない。その低レイテンシと高いスループットは、ビッグデータや分析の用途に最適だ。
ビッグデータのワークロードの特性を見ると、フラッシュに合う点が多数存在する。
低いレイテンシと高いIOPS
分析タスクでは一般に入出力(I/O)が集中的に行われ、同じデータを何度も読み取ったり、読み取り直したりすることが多い。
データセット全体が処理の対象になる場合、キャッシュによって得られるメリットはほとんどない。そのため、分析の応答を速くするには、できる限り高速に動作するストレージが必要になる。
本稿後半のまとめで紹介する製品のレイテンシは(読み取りと書き込みのアクティビティーに応じて)100マイクロ秒以下が目標になっている。これは、サーバに直接導入されるPCIe SSDデバイスに匹敵する数値だ。
スケーラビリティ
ビッグデータとはデータ量の問題に他ならない。とてつもない速さで生み出される情報をできる限り多くデータとして取り込んで分析することで、洞察や価値が得られる。フラッシュベースの分析システムには、P(ペタ)B単位の容量へのラックレベルのスケーラビリティが求められる。
並列処理
Hadoopなどのプラットフォームは、クエリのワークロードを分割し、分割した多数のワークロードを並列実行するという考え方を中心に設計されている。Hadoop開発当時、I/Oスループットを得るには多数のHDDを使用し、多数の物理サーバに処理を分散する方法しかなかったことから、このような手法が考案された。
フラッシュを利用すると、多くのサーバのワークロードを1つシステムに統合できる可能性が高い。パフォーマンスを確保するため、このようなシステムはI/Oを並列処理できる必要がある。NVMeなどのテクノロジーを導入することで、従来のストレージよりもはるかに多くの同時入出力タスクを実行できると考えられている。
ランダム性
大半の分析処理は本質的にランダムに行われる。そのため、次にデータのどの部分が必要になるかを予測するのは困難だ。このような場合にフラッシュが適している。フラッシュは、ランダムなI/O要求に一貫して対処できる。
前述のように、大量のデータセットを迅速に読み取る状況では、キャッシュはI/Oのステージング領域になるだけで実用的ではない。このような状況では、全てのデータに対する一貫したI/O応答が重要になる。
多くの分析環境では、読み取りが集中して行われることも考慮する必要がある。ビッグデータシステムでは、データは(絶えず更新されるよりも)追加される方が一般的だ。従って、大多数のI/Oは処理データの読み取りになる。
3D NANDやTLCなどの新しいテクノロジーを使用するスケールアウトフラッシュシステムは、高密度のフラッシュシステムになるが、SLCやMLCベースのデバイスに比べて耐久性は低い。だが、読み取り処理が主となる環境では耐久性の低さは重要ではない。
HPC向けフラッシュ
続きはComputer Weekly日本語版 1月11日号にて
本記事は抄訳版です。全文は、以下でダウンロード(無料)できます。
■Computer Weekly日本語版 最近のバックナンバー
Computer Weekly日本語版 12月21日号 知らないと損をするライセンス監査の罠
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
新着ホワイトペーパー PR
-
事例
[日本オラクル株式会社] ピンチをチャンスに変えたEPR製品は? 先行企業の導入事例3選 -
技術文書・技術解説
[日本オラクル株式会社] 無自覚なリスク 秘伝Excelファイルが監査の壁、不正・ミスの温床となる理由 -
製品資料
[日本オラクル株式会社] 戦略的経理の第一歩 失敗のない「脱Excel」を実現する秘訣とは? -
技術文書・技術解説
[日本オラクル株式会社] いまさら聞けないオンプレERPとクラウドERPの違い 最適な製品をどう見極める? -
事例
[株式会社ビザスク] 連結売上高が約2倍に成長、富士フイルムが実践した新規事業創出の戦略とは?
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
損保ジャパンはなぜ「COBOL」を捨てなかったのか? 脱メインフレームの真相
-
2
なぜ「全社配布Copilot」は使われないのか? 失敗に学ぶAI定着
-
3
「ノートPC派」は損をしている? Dellと考える“自作PC”のメリット
-
4
生データを隠してデータ連携 KDDIが4000万人の顧客情報を安全に分析できた理由
-
5
慶應義塾が「Notion」を選んだ理由 AI導入の盲点になる“情報のサイロ化”
-
6
「0.3秒のスピード顔認証」の入退室管理が社員に好評 事例に学ぶオフィス改革
-
7
エンジニアの生産性はどう測る? マネジメントに不可欠な可視化の実現方法とは
-
8
大阪証券取引所がHiRDBで実現した「世界トップレベルの応答速度」を誇る新売買システム
-
9
IT製品の導入に関するアンケート「PC&デバイス」編
-
10
「IoT通信環境の構築・運用」に関するアンケート
ホワイトペーパーランキング PR
-
1
DX/AI投資の壁を突破、現代の最高財務責任者が直面する課題と克服のヒント
-
2
不審メールの経路や見せ方に変化? 2026年夏の3事例から見えた動向と対処方法
-
3
「オンプレミス回帰」せざるを得ない“合理的な理由”
-
4
バックアップは“取っているから大丈夫”なのか? ランサムウェア時代の備え方
-
5
システムの保守がモダン化を阻む? 「変えない判断」から脱却する方法とは
-
6
生成AIを開発に導入しても効果が見えない? 実証実験で分かった成果と課題
-
7
経産省DX指針から読み解く、受発注業務デジタル化ロードマップ
-
8
5分で分かる Microsoft 365のデータ損失に備えるためのバックアップの仕組み
-
9
ネットワーク遅延の原因、「パケットロス」の基礎知識と効果的な解決策
-
10
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー