クラウド化でHAも現実的に
一般企業でも構築できる、ハイパフォーマンスコンピューティングのススメ
最近まで、ハイパフォーマンスコンピューティングシステムは科学者など専門家だけのものだった。だが、今では多くの一般企業も利用し始めている。
これまでハイパフォーマンスコンピューティング(HPC)と高可用性(HA)を兼ね備えたシステムは、学者、エンジニア、科学者だけのものだった。しかし、ビッグデータとクラウドコンピューティングの利用拡大に伴い、その他の多くの企業もこのようなITインフラの利用を望んでいる。
Computer Weekly日本語版 2014年1月8日号無料ダウンロード
本記事は、プレミアムコンテンツ「Computer Weekly日本語版 2014年1月8日号」(PDF)掲載記事の抄訳版です。本記事の全文は、同プレミアムコンテンツで読むことができます。
なお、同コンテンツのEPUB版およびKindle(MOBI)版も提供しています。
HPCは並列処理により、高度なアプリケーションプログラムを効率良く、安定して、素早く実行することだ。以前は、HPCシステムは極めて特殊なコンピュータだと見られていた。これには、エンジニアリングや設計システムに使われたCISCベースのIBM RS600やHP PA-RISCシステムなど、“スペシャリスト・ゼネラリスト”コンピュータ(つまり、特定のワークロード用で、多数製造されたシステム)から、大掛かりな数値演算用に非常に特殊なチップを使った特注のスーパーコンピュータまで含めることができるだろう。
HPCシステムの最大の利用者は、科学者、研究者、エンジニア、学術機関、一部の公共機関だが、さらにあらゆる規模の企業が、処理性能と処理速度を求めて、HPCシステムへと向かっている。この傾向は、特にトランザクション処理とデータウェアハウス関連で見られる。
一方、HAは、システムやコンポーネントが長時間にわたり運用を継続できることを表す。HAシステムの場合、システムの“ハートビート”を監視し、冗長システムへのフェイルオーバーを管理する専用のソフトウェアを備えた複雑なサーバクラスタが一般的だった。多くの企業が、99%を超える可用性で汎用システムを運用していることを誇りにしていた。目標は、「five nines five」(99.9995%)の可用性、つまり計画外のダウンタイムが1年に2.5分間以下の稼働率を実現することだった。
かつて、HPCとHAの両方を実現するには多大な費用を要した。可用性が高く、かつパフォーマンスも優れているシステムを用意できる組織はごく小数だった。しかし現在は、HPCもHAも、システムの設計にはなから組み込まれていることが望ましい。ビッグデータやクラウドコンピューティングなど、新しい技術的アプローチには、目下のワークロードに必要なだけのリソースを備えているだけでなく、ワークロードの要件の変化に応じてリアルタイムでリソースを追加できるテクノロジープラットフォームが必要だ。HPCとHAを兼ね備えたシステムなら、この要件を、計画したダウンタイムも無計画のダウンタイムも皆無かそれに近いレベルの稼働率の下で実現できるだろう。
可用性の高いHPCデータセンターを構築
現在はかつてないほど、可用性の高いHPCデータセンターの構築が容易になっている。仮想化とクラウドコンピューティングが、高可用性を実現する手段を提供している。コンピュータ、ストレージ、ネットワークの3大リソースのプールを賢く仮想化することで、1つのコンポーネントで障害が発生しても、プラットフォームの他のコンポーネントの運用への影響はほぼゼロになる。
「影響がほぼゼロ」というのが、ここでは鍵になる。仮想化したプールが、例えば100個のコンポーネントで構成されている場合、1コンポーネントの障害は全体の1%にすぎず、パフォーマンスへの影響は最小限に抑えられる。一方、仮想化されたプールのコンポーネントが10個しかなければ、影響は10%になる。
データセンター担当者は、仮想化を利用することでシステム自体の可用性を向上できるが、これは万能の解決策ではないことに注意してほしい。アプリケーションの仮想イメージ、仮想ストレージプール、仮想ネットワークパスは、それぞれに割り当てられた物理リソースに依存することに変わりはない。データセンターを設計する際、この点を考慮する必要がある。
仮想イメージを実行しているサーバで障害が発生した場合、やはり物理サーバシステムのどこか別の場所で新しいイメージを起動し、接続を割り当て直す必要がある。VMware vSphere HA、Veeam Backup & Replication、Vision SolutionsのDouble-Takeなど、適切なソフトウェアがあれば障害復旧を自動化でき、会社への影響は最小限に抑えられる。多くの場合、ユーザーはサービスの中断に全く気付かない。
ストレージレベルでは、ライブデータのミラーリングが必要だ。正真正銘のHAを実現するには、アクティブ/アクティブ構成でリアルタイム同期を行うアプローチを採用する必要がある。これは、スナップショットを利用することで、ニアリアルタイムを実現できる。ストレージアレイの障害発生時に、定期的に作成していたライブデータのコピーを基に“新しい”アレイを素早く作成し、提供すればよい。ほとんどのストレージベンダーは独自のストレージHAを提供しているが、EMC、NetApp、Dell、IBM、Hitachi Data Systems、HPはいずれも、各社の汎用のストレージ製品にHA機能を追加した上位バージョンを用意している。
ネットワークについては、より“ファブリック”なネットワークに移行することで、HAを向上できる。端点が決められたポイントツーポイント接続ではなく、ベストエフォート型の構成である階層型ネットワークトポロジには、基本的なHA機能がある。しかし、これは低速であることも意味し、障害発生後の再構成に時間がかかり、なかなかパフォーマンスが回復されない可能性がある。
ファブリックネットワークはネットワークの階層を取り除き、いずれかのコンポーネントで障害が発生した場合に、より動的にネットワークを再構成できる。このとき、以下の点が重要だ。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
新着ホワイトペーパー PR
-
製品資料
インシデント発生後に最も重要な「最初の48時間」 どう乗り切る? -
製品資料
急激なデジタル化の裏で増大するデバイスのリスク 東急建設はどう対処した? -
製品資料
「フロンティアAI」実践解説:セキュリティ対応に向けた5つのステップ -
製品資料
WSUS非推奨化でさらに混迷 複雑化するサーバ環境の運用負荷をどう解消する? -
市場調査・トレンド
数百万台規模のデータで判明、企業のIT環境に潜む「見えない課題」とは
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
Microsoft製品でここまで自動化できる 情シスがやめられる手作業10選
-
2
Oracle巨大ITプロジェクトはなぜつまずいたのか 8年で導入1割、追加で170億ドル
-
3
ISMSの“コンサル丸投げ”が招く数千万円の無駄 NTTドコモビジネスの脱出劇
-
4
IBM iのブラックボックス化を打破 資産継承と進化を実現する「IBM Bob」の実力
-
5
「即戦力」は幻想? 中途の3割が消えるAI時代のエンジニア生存戦略
-
6
同じ攻撃で明暗 CISAの侵入テストで見えた「機能するSOC」3つの鉄則
-
7
AIインフラの理想形? 「5層のケーキ」を垂直統合するための近道とは
-
8
ランサムウェア被害額が平均3.5億円に拡大 なぜ企業の復旧は遅れるのか
-
9
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
10
VMware離れを食い止めるか? 今「VCF 9.1」が再評価される理由
ホワイトペーパーランキング PR
-
1
AIエージェントで多様な日常業務を効率化するための入門ガイド
-
2
財務・会計はAI活用でどう変わる? 調査で見えた変革の道筋
-
3
AIが「わざわざ使うツール」になっていない? 業務で自然に使う導線にする秘訣
-
4
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
5
「脱Excel」か「Excel快適化」か? 現場にやさしい業務改善の進め方
-
6
「結局、一部の人しか使わない」 AI活用が業務に定着しない根本的な理由
-
7
コスト分析で見る「デバイス復旧」の代償 損失額から導きだされた投資戦略とは
-
8
Macの安全神話は崩壊? 最新の脅威動向から見えた攻撃のトレンドと有効な対策
-
9
ゼロトラストにおける「IDaaSの課題」と補完すべき重要機能とは?
-
10
情報セキュリティ対策早分かりガイド:25の自社診断で弱点と解決策を理解
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー