インメモリ処理のバックエンドストレージを考える
「NVDIMM」はなぜインメモリデータベースの“相棒”になり切れないのか?
高速なデータ処理を可能にする「インメモリデータベース」は、電源を切るとデータを保持できないのが一般的だ。そのためバックエンドのストレージシステムが重要になるが、技術選定は容易ではない。
インメモリ処理を活用すると、HDDやSDD(ソリッドステートドライブ)のストレージ処理で発生するデータ転送のレイテンシ(遅延)を回避できる。ただしバックエンドに、どのようなストレージを使用するかを考える必要がある。
データベースをメインメモリ内に保持する「インメモリデータベース」は、ストレージに保持する「オンディスクデータベース」の一次キャッシュメモリより、ずっと多くのメリットをもたらす。インメモリデータベースはほとんどの場合、キャッシュメモリやその他のプロセス用の不要なI/O処理を全てなくし、データベースそのものを更新できる。データを正しく記録したかどうかを確認する「リードアフターライト」の検証処理も非常に高速だ。データベース処理を大幅に高速化し、複数のサーバでデータベースを構成する「データベースクラスタ」に必要なサーバの数も削減できる。
NVDIMMの登場
インメモリデータベースの採用には課題もある。全てをDRAMで処理すればパフォーマンスが向上する半面、サーバの障害発生時にはDRAMの内容が空になってしまい、データを失うことになる。電源が失われてもデータベースの一部または全部を保持する永続性を確保できれば、インメモリデータベースの用途は広がる。その場合は、バックエンドにどのようなストレージを使うべきかを考えなければならない。
これまでであれば、ストレージ接続規格NVMeに準拠したSSDや、PCI Express(PCIe)カードにフラッシュメモリを搭載した「PCIeフラッシュカード」に保存することを推奨していた。DRAMから永続的にデータを保持可能なストレージ(以下、永続的ストレージ)へデータを移すには、それが最も速かったからだ。
現在は永続的ストレージの要素技術として、不揮発性メモリ規格「NVDIMM」も選択肢に入ってきた。NVDIMMは、一般的なメモリモジュール規格「DIMM」のフォームファクタ(形状や仕様)に、DRAMやNANDフラッシュメモリをまとめたメモリ規格だ。
NVDIMMは高速なバスとメモリI/O方式を使用しており、SSDと比べて非常に高速に動作する。これをDRAMと組み合わせて使うと、インメモリデータベースにシームレスかつ大容量のメモリ領域を利用でき、データを複数のサーバに分散する「シャーディング」の問題を避けることができる。
ただしNVDIMMは、そのサイズの小ささからSSDよりも一般的に容量制限が厳しく、ビッグデータの処理には問題がある。センサーから連続的に取得するストリームデータや、大部分はアクセスすることのない非常に大きなサイズのデータを処理するには、どうしたらよいか。
代替策は2つある。
1つはNVMe準拠のSSDを使用してネットワークストレージを作成する方法。もう1つは、それより遅いSSDを多数使用する方法だ。後者の場合、パフォーマンスはNVMe準拠SSDよりも劣るが、ずっと安価で並列性が高い。どちらを選ぶかはユースケース次第だ。
インメモリ処理では、高いデータ転送速度を実現する接続インタフェースが非常に有効だ。イーサネットを介して、異なるコンピュータのメモリへのデータ転送(RDMA: Remote Direct Memory Access)を可能にする「RoCE」(RDMA over Converged Ethernet)を使って、メモリベースのシステム間でデータを共有したり、それを一般的なドライブベースのストレージシステムに拡張したりすることができる。
インフラストラクチャの進化
インメモリ処理のインフラストラクチャは急速に進化している。特にNVDIMMとCPUのアーキテクチャで興味深い変革が進行中だ。
例えばIntelの不揮発性メモリモジュール「Intel Optane Memory」は「バイトアドレス指定」を可能にする計画だ。バイトアドレス指定とは、CPUが1バイト単位でアドレスを指定して、データの書き込みができるようにすることを指す。一般的にNANDフラッシュメモリと同様の4KBブロック単位のI/O方式を取るNVDIMMよりも、はるかに高速だ。
バイトアドレス指定を実現するには、システムのコードを全面的に書き直さなければならない。それでも従来のモノリシック(一枚岩)なアプリケーションに適用するよりは、データベースエンジンに適用する方がずっと簡単なので、まずはこの分野で実現することになるだろう。
ビッグデータ環境では、ネットワークとローカルストレージのデータ転送速度が、パフォーマンスのボトルネックとなる可能性がある。その解決策はデータ圧縮だ。圧縮の程度はデータによって異なるが、5分の1が一般的である。CPU側では、サーバ内でメモリ、GPU(画像処理プロセッサ)、CPU、ドライブベースのストレージをフラットかつ超高速に結ぶファブリック型のトポロジーに注目すべきだ。
CPUとメモリの連携を密にすることによって、DRAM容量の増大とパフォーマンスの向上を目指す動きもある。複数のプロジェクトがベースにしているのが、次世代DRAM「Hybrid Memory Cube」のコンセプトだ。これらのプロジェクトは、テラバイト毎秒のデータ転送速度、メモリの省電力化、メモリとCPUのモジュールアーキテクチャ構築などを目標としており、インメモリ処理の大幅な高速化を目指す。
こうしたプロジェクトは、それぞれ別の道を進んでいるとしても、大幅なパフォーマンス向上を目指していることには変わりがない。これによってインメモリシステムと、それを活用したストレージおよびストレージシステムの活用機会も拡大していくだろう。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品レビュー
「電子帳簿保存法対応」実践術:タイムスタンプ付与などの要件の手軽な実現方法 -
事例
「大企業のデジタル化」成功事例集【コクヨ、九州電力、ヨネックスなど21社】 -
製品資料
“顧客管理の課題”を簡単に解決する方法とは? -
製品資料
契約管理の“あるある課題”をノーコード開発で解決するためのポイント -
製品資料
揺らぐ境界防御 いま企業が特に警戒すべき「3つのセキュリティ課題」とは?
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
Microsoft製品でここまで自動化できる 情シスがやめられる手作業10選
-
2
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
3
自宅のWi-Fiが「遅い」「途切れる」本当の原因は? Dellが推奨する鉄則
-
4
継続利用は4割どまり M365 Copilotが「効く業務」と期待外れの境界
-
5
画面をティッシュで拭くのはNG Dellが推奨するPCの正しいお手入れ方法
-
6
Oracle巨大ITプロジェクトはなぜつまずいたのか 8年で導入1割、追加で170億ドル
-
7
VDI運用の“生きたノウハウ”を共有 歴史あるユーザー会の魅力とは?
-
8
メインフレームは死なず AI活用で20年来の高収益をたたき出す基幹システムの底力
-
9
VMware離れを食い止めるか? 今「VCF 9.1」が再評価される理由
-
10
「GitHub Copilot」3000人に配布も基本機能しか使われない 保険大手が得た教訓
ホワイトペーパーランキング PR
-
1
AIエージェントで多様な日常業務を効率化するための入門ガイド
-
2
AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
-
3
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
4
5回聞くだけじゃ足りない? トヨタ式「なぜなぜ分析」の正しい実践方法
-
5
「脱Excel」か「Excel快適化」か? 現場にやさしい業務改善の進め方
-
6
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
7
「結局、一部の人しか使わない」 AI活用が業務に定着しない根本的な理由
-
8
AIエージェントで成果は出る? 調査結果に見る費用対効果の実態
-
9
PostgreSQLの「機能」「性能」「運用」「拡張性」に関する悩みの解消法
-
10
ゼロトラストにおける「IDaaSの課題」と補完すべき重要機能とは?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー