クラウド化でHAも現実的に
一般企業でも構築できる、ハイパフォーマンスコンピューティングのススメ
最近まで、ハイパフォーマンスコンピューティングシステムは科学者など専門家だけのものだった。だが、今では多くの一般企業も利用し始めている。
これまでハイパフォーマンスコンピューティング(HPC)と高可用性(HA)を兼ね備えたシステムは、学者、エンジニア、科学者だけのものだった。しかし、ビッグデータとクラウドコンピューティングの利用拡大に伴い、その他の多くの企業もこのようなITインフラの利用を望んでいる。
Computer Weekly日本語版 2014年1月8日号無料ダウンロード
本記事は、プレミアムコンテンツ「Computer Weekly日本語版 2014年1月8日号」(PDF)掲載記事の抄訳版です。本記事の全文は、同プレミアムコンテンツで読むことができます。
なお、同コンテンツのEPUB版およびKindle(MOBI)版も提供しています。
HPCは並列処理により、高度なアプリケーションプログラムを効率良く、安定して、素早く実行することだ。以前は、HPCシステムは極めて特殊なコンピュータだと見られていた。これには、エンジニアリングや設計システムに使われたCISCベースのIBM RS600やHP PA-RISCシステムなど、“スペシャリスト・ゼネラリスト”コンピュータ(つまり、特定のワークロード用で、多数製造されたシステム)から、大掛かりな数値演算用に非常に特殊なチップを使った特注のスーパーコンピュータまで含めることができるだろう。
HPCシステムの最大の利用者は、科学者、研究者、エンジニア、学術機関、一部の公共機関だが、さらにあらゆる規模の企業が、処理性能と処理速度を求めて、HPCシステムへと向かっている。この傾向は、特にトランザクション処理とデータウェアハウス関連で見られる。
一方、HAは、システムやコンポーネントが長時間にわたり運用を継続できることを表す。HAシステムの場合、システムの“ハートビート”を監視し、冗長システムへのフェイルオーバーを管理する専用のソフトウェアを備えた複雑なサーバクラスタが一般的だった。多くの企業が、99%を超える可用性で汎用システムを運用していることを誇りにしていた。目標は、「five nines five」(99.9995%)の可用性、つまり計画外のダウンタイムが1年に2.5分間以下の稼働率を実現することだった。
かつて、HPCとHAの両方を実現するには多大な費用を要した。可用性が高く、かつパフォーマンスも優れているシステムを用意できる組織はごく小数だった。しかし現在は、HPCもHAも、システムの設計にはなから組み込まれていることが望ましい。ビッグデータやクラウドコンピューティングなど、新しい技術的アプローチには、目下のワークロードに必要なだけのリソースを備えているだけでなく、ワークロードの要件の変化に応じてリアルタイムでリソースを追加できるテクノロジープラットフォームが必要だ。HPCとHAを兼ね備えたシステムなら、この要件を、計画したダウンタイムも無計画のダウンタイムも皆無かそれに近いレベルの稼働率の下で実現できるだろう。
可用性の高いHPCデータセンターを構築
現在はかつてないほど、可用性の高いHPCデータセンターの構築が容易になっている。仮想化とクラウドコンピューティングが、高可用性を実現する手段を提供している。コンピュータ、ストレージ、ネットワークの3大リソースのプールを賢く仮想化することで、1つのコンポーネントで障害が発生しても、プラットフォームの他のコンポーネントの運用への影響はほぼゼロになる。
「影響がほぼゼロ」というのが、ここでは鍵になる。仮想化したプールが、例えば100個のコンポーネントで構成されている場合、1コンポーネントの障害は全体の1%にすぎず、パフォーマンスへの影響は最小限に抑えられる。一方、仮想化されたプールのコンポーネントが10個しかなければ、影響は10%になる。
データセンター担当者は、仮想化を利用することでシステム自体の可用性を向上できるが、これは万能の解決策ではないことに注意してほしい。アプリケーションの仮想イメージ、仮想ストレージプール、仮想ネットワークパスは、それぞれに割り当てられた物理リソースに依存することに変わりはない。データセンターを設計する際、この点を考慮する必要がある。
仮想イメージを実行しているサーバで障害が発生した場合、やはり物理サーバシステムのどこか別の場所で新しいイメージを起動し、接続を割り当て直す必要がある。VMware vSphere HA、Veeam Backup & Replication、Vision SolutionsのDouble-Takeなど、適切なソフトウェアがあれば障害復旧を自動化でき、会社への影響は最小限に抑えられる。多くの場合、ユーザーはサービスの中断に全く気付かない。
ストレージレベルでは、ライブデータのミラーリングが必要だ。正真正銘のHAを実現するには、アクティブ/アクティブ構成でリアルタイム同期を行うアプローチを採用する必要がある。これは、スナップショットを利用することで、ニアリアルタイムを実現できる。ストレージアレイの障害発生時に、定期的に作成していたライブデータのコピーを基に“新しい”アレイを素早く作成し、提供すればよい。ほとんどのストレージベンダーは独自のストレージHAを提供しているが、EMC、NetApp、Dell、IBM、Hitachi Data Systems、HPはいずれも、各社の汎用のストレージ製品にHA機能を追加した上位バージョンを用意している。
ネットワークについては、より“ファブリック”なネットワークに移行することで、HAを向上できる。端点が決められたポイントツーポイント接続ではなく、ベストエフォート型の構成である階層型ネットワークトポロジには、基本的なHA機能がある。しかし、これは低速であることも意味し、障害発生後の再構成に時間がかかり、なかなかパフォーマンスが回復されない可能性がある。
ファブリックネットワークはネットワークの階層を取り除き、いずれかのコンポーネントで障害が発生した場合に、より動的にネットワークを再構成できる。このとき、以下の点が重要だ。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
新着ホワイトペーパー PR
-
製品資料
[o9ソリューションズ・ジャパン株式会社] 「改正物流効率化法対策」徹底解説 総物流費を抑制するサプライチェーン戦略 -
製品資料
[o9ソリューションズ・ジャパン株式会社] 「サプライチェーン最適化」実践ガイド:効果的な意思決定を実現する秘訣とは? -
製品資料
[株式会社リンプレス] 非デジタル/IT人材を「自走するDX推進者」に変えるための育成ロードマップ -
市場調査・トレンド
[ワンアイルコンサルティング株式会社] AI時代の組織設計:「判断と責任」を人に残すための2つの原則とは? -
技術文書・技術解説
[ワンアイルコンサルティング株式会社] システムの保守がモダン化を阻む? 「変えない判断」から脱却する方法とは
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
「完璧な設計」なのに3000万円溶けた AWSの失敗事例から学ぶ3つの教訓
-
2
1200万円のSaaS導入を回避 スギ薬局「運用費10万円」のAIエージェント構築術
-
3
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
4
LLMの「過学習」、正しく説明している文章はどれ?
-
5
「AIバブル」は崩壊するのか? 熱狂の後に来る“尻拭い”と4つの防衛策
-
6
パナソニックが国内製造26拠点のERPを「SAP S/4HANA」に統一 アドオン7割削減
-
7
脱VMwareの前提が崩れる BroadcomのVDDK公開停止で確認すべき点
-
8
高額な「AI PC」を一般従業員も使えたら? 費用のハードルを一気に下げる方法
-
9
守るべきは「開発者のフロー状態」 AIによる生産性改善の6施策
-
10
「RAGの利用」に関するアンケート
ホワイトペーパーランキング PR
-
1
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
2
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
3
生成AIで文書活用を進めるには? 効率化と安全性をどう両立する
-
4
Windows PCとMacの選択制で生産性向上 LINEヤフーが実践する運用管理方法とは
-
5
DX/AI投資の壁を突破、現代の最高財務責任者が直面する課題と克服のヒント
-
6
「Google Workspace」活用事例34選、先進の生成AIによる組織変革の全貌
-
7
「人員を増やす」という選択肢はない 情シスが負の連鎖から抜け出すには?
-
8
Linuxのスキルを証明する“激推し”の認定資格はこれだ
-
9
「問題が深刻化しやすいプロジェクト管理」から脱却する方法とは?
-
10
Microsoft 365を安全に運用 うっかりミスやサイバー攻撃に備えるデータ保護術
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー