大規模DCの課題を解決するネットワーク最新技術【第5回】
【技術解説】ネットワーク運用管理業務を効率化・自動化する技術
ネットワークの運用管理コストは下げられるにこしたことはない。しかし、ダウンタイムやパフォーマンスの低下につながるのでは本末転倒だ。運用コスト低減とサービスレベル維持を両立させる新技術を紹介する。
企業のシステム部門や通信キャリアにおいて、「運用コスト削減」は、重要なキーワードの1つだ。だが、運用コストは重要なITインフラの保守・運用に必要なものであり、システムのサービスレベルにも密接に関わる。サービスレベルを維持しながら運用コストだけを削減するのは非常に難しいのが現実だ。
ネットワークの運用管理でも、管理すべきネットワーク機器が増えれば増えるほど多くのスタッフが必要になり、各スタッフに求められるスキルはますます高度になる。ドキュメント作成やオペレーションの確立など、ネットワークを維持運用するための労力とコストは増加する一方だ。
しかし、ネットワークの運用管理業務をなくすことはできないので、サービスレベルを下げずに運用コストを抑えるには、「効率化」や「自動化」がポイントとなる。本稿では、データセンターのネットワークにおける運用管理業務の効率化・自動化に寄与するテクノロジーを紹介する。
1.無停止運用と設定作業簡素化を可能にするテクノロジー
致命的なソフトウェア不具合やセキュリティに関する脆弱性が見つかった場合、即座にソフトウェアのバージョンアップを行う必要があるが、データセンターにおいてダウンタイムを伴う停止調整を行うことは非常に困難になってきている。そこで、無停止バージョンアップ(ISSU:In Service Software Upgrade)機能を有する製品の採用を検討する価値が出てくる。最近では、米Cisco SystemsのNexus 5500シリーズのように、ボックス型(シャーシ型でない)スイッチであるにもかかわらず、ISSUをサポートしている製品も登場している。ただし「無停止バージョンアップ機能」といっていても、製品によっては数秒程度のダウンが発生するものや、ネットワークのトポロジー制限などがある場合もあるので、導入の際には詳細な動作についての確認が必要だ。
またネットワーク構成も複雑化傾向にあるので、いかにシンプルに実現・維持できるかもポイントとなる。新しいシステムの導入や多少の要件変更に際して、複雑なネットワーク設計を強いられたり、さまざまな箇所の設定変更が必要になったりすることは避けるべきだ。
計画的なメンテナンス時間を確保する場合でも、ダウンタイムの短縮や設定ミスを低減する方法を検討しなければならない。
このような課題に対して、下の図のように複数のスイッチを一元管理できる機能が、さまざまなベンダーからリリースされている。これらの方式は全て、複数のスイッチでクラスタ構成を組み、あたかも1つの仮想機器であるかのように管理や設計ができる点では同じだが、各方式にそれぞれ特徴がある。
- スタッキング:同じ場所に設置された機器を統合(専用ケーブルは数メートルと短い場合が多い)。多数のベンダーが現行製品でサポート
- 仮想シャーシ:スイッチ同士の接続にイーサネットを使うため距離が離れた機器の統合も可能 。スタッキングよりも多くの機器を統合でき、スイッチ増設時の運用がシンプル。その他、ベンダーごとにさまざまな特徴がある(例:米BrocadeのVCS、米Juniper NetworksのQFabric/Virtual Chassis など)
- ポート拡張(IEEE 802.1BR):コントロールブリッジがポートエクステンダを制御する主従関係 。エクステンダは低コストだが単体では動作しない。エクステンダ増設・交換時の運用がシンプル(例:Cisco Fabric Extender)
どの方式も設定箇所および設定量の削減、複数スイッチ間での設定の自動同期(Config Sync)、バージョンアップの一元化、設計のシンプル化、トラブルシュートの容易性などが実現できるため、メンテナンスの準備をはじめとした運用にかかる時間の削減、コスト削減、ヒューマンエラーの低減効果が期待できる。
2.ネットワーク機器の設定自動化機能
ネットワーク機器の設定箇所の削減だけでなく、設定自体を自動化する機能もある。例えば、スイッチなどの機器を追加し、配線・起動した際に、運用中の環境で利用しているOSイメージや標準的な設定が自動的に投入され、すぐに使える状態になるというものだ。
最近のデータセンターではサーバラックごとにスイッチを配置することでサーバ~スイッチ間のLAN配線を効率化するTop of Rack(トップ・オブ・ラック:各ラックの最上部にスイッチが配置される)方式が採用されることが多い。サーバの増設に伴うスイッチの増設が頻繁に行われる場合が多いため、このような仕組みによる運用負荷軽減のメリットは大きい。
初期設定自動化機能には、大きく分けて以下の2タイプがある。
- 機器単体の機能。機器が初回起動すると、直接接続されたUSBメモリやネットワーク接続されたFTPサーバなどを参照し、OSイメージや設定を自動的にダウンロードしてインストールする
- 既に紹介した仮想シャーシ(クラスタリング)に組み込まれている機能。仮想シャーシのメンバーを増設するために新しい機器を既存メンバーと接続した上で起動すると、OSイメージや設定が既存メンバーから自動的に読み込まれ、インストールされる
特に後者の機能は外部サーバなど特別な準備を必要とせず、運用上自然な形で自動化のメリットを享受できる。また、増設時だけでなく、特定の仮想シャーシメンバーが故障した際に、交換用の機器を同じ場所に接続するだけで、故障前の機器と全く同じ状態(OS、設定)に自動設定してくれる製品もある(例:Cisco Nexus 2000シリーズ)。
ベンダーごとに特徴が異なるが、既に多数の企業のデータセンターで実際に利用され、運用負荷の軽減に役立てられている。
3.プログラミングによる自動化
上述の機能は「ネットワーク機器の展開時の初期設定の自動化」といえるが、運用中のネットワークに対する設定追加や変更を自動化したいというニーズも増えている。
システムのクラウド化によって迅速性・即応性が求められる昨今のデータセンターの運用において、サーバの運用は仮想化技術の進歩によりある程度の自動化を達成できたが、ネットワークは従来型の手動運用(人手を伴う作業が都度発生する)から脱却できないという声がよく聞かれる。手動の運用は時間がかかるだけでなく、オペレーションミスを発生させる要因でもある。
このようなニーズへの対応策として、APIを用いたネットワーク機器のプログラミングやスクリプティングによる自動化への対応がある。現在ではPythonなどの言語をサポートし、管理者が以下のようなカスタマイズをすることが可能なスイッチが非常に多くなっている。
- 設定追加・変更の自動化
- スイッチの起動時や特定の日時(定期的)に機器やネットワークの情報を自動的に取得
- 機器やネットワークの情報を取得し、任意の条件でアラートを上げる(例:Syslogやメールによる管理者通知)
しかし、このような仕組みを利用しているユーザー企業は非常に少ないのが現実だ。いろいろな要因があると思われるが、まず上記のAPIによる制御は基本的に、ベンダーごとに使い方や実現できることが違う。また、ユーザーは個々の機器(シャーシ)単位の制御をする必要があり、ネットワーク全体を俯瞰する仕組みは組み込まれていない。従って、機器単体のコマンド実行の自動化はできても、ネットワーク全体を意識した自動化の仕組みを作り上げるのは非常に難しい。
そこで、ネットワークの全体最適化とプログラマブルなインタフェース(API)をオープンな業界標準として提供することを目指すSDN(Software Defined Networking)が注目を集めている。詳細については別記事を参照していただきたいが、SDN、特にホップ・バイ・ホップと呼ばれる方式が今後一般企業にとっても実用できる段階に達すれば、ネットワーク運用自動化のハードルは大きく下がるかもしれない。
4.本連載で紹介したDCテクノロジーでの運用管理と自動化
本連載のこれまでの記事で紹介済みのテクノロジーにも、運用管理面のメリットがある。第2回 【技術解説】ネットワークの設計や拡張を容易にする「ファブリック」では「最短パス」「マルチパス」「STPの排除」といった通信転送最適化の観点でファブリックを紹介したが、データセンターのネットワークにおけるサーバやストレージ収容の管理を楽にできるというメリットもある。
従来のLAN設計では、コアスイッチを頂点に階層型(ツリー型)のネットワークを作ることが一般的だった。しかしこの場合、大規模なLANになると、階層の数とそれを集約するスイッチの段数が多くなってしまい、サーバ同士が通信する際、ネットワーク的に「近い」通信相手と「遠い」通信相手ができてしまう。当然、通信・連携の多いサーバ同士はネットワーク的に近い場所に配置することが望ましいので、サーバ配置はネットワークトポロジを意識して設計、管理する必要があった。
一方ファブリックでは、集約スイッチを階層化するのではなく、横方向にスケールアウトできる。これにより、LANに接続されている全てのサーバが均一な性能(経由スイッチ数、帯域、遅延)で互いに通信できる「フラット」なネットワークを実現することができる。このため、サーバ配置の管理が楽になる(ネットワークトポロジを気にする必要がない)というメリットがある。
5.ネットワークの運用管理コストの削減
今回紹介したテクノロジーは各ネットワークベンダーのデータセンター向け製品ラインアップにおいてさまざまな形でサポートされているので、自社の環境・要件にマッチした機器を選定した上で、運用効率の向上やダウンタイムの短縮と運用コスト削減に役立てていただきたい。ただ、今回紹介のテクノロジーを実装している機器は割高であったり、テクノロジーの利用にライセンスコストが掛かったりするる場合もあり、コスト削減効果を判断できないという声もよく聞く。これは、ネットワークの管理業務をしていない、もしくはメンテナンスに関わる工数を把握していないことなどが主な原因であり、効率化と自動化を実現した際に、「どの作業工程をどれくらい工数削減できるか」についてシミュレーションができないということである。
このような状況では、運用を効率化する最新技術のメリットを享受しにくい。難しい問題ではあるが、今回紹介したものだけでなく、今後も技術の進歩によりさまざまな運用効率化のテクノロジーが登場することは自然な流れである。それらのテクノロジーが自社の運用コスト削減にどれだけ寄与できるかについて、適切に評価・判断する仕組みを持つことは非常に重要だ。
著者紹介
大高智也(おおたか ともや) ネットワンシステムズ株式会社
1997年から約10年間、国内大手金融業や製造業などのデータセンターネットワークや企業ネットワーク全体(LAN/WAN)の構築において、最先端技術の安定導入を実現しながらプロジェクトを遂行してきた。現在はネットワンシステムズでマルチベンダーのデータセンターネットワーク製品の技術サポートを行っている。2005年、Cisco CCIE Routing and Switching取得。
中前 航(なかまえ わたる) ネットワンシステムズ株式会社
2005年から、企業ネットワークにおける先進技術導入の提案や構築に関わる。テクニカルプレセールスとして、多くの企業の現状や課題を見てきた。現在はネットワンシステムズでDCネットワーク製品/技術の比較検討と提案を担当。2009年、Cisco CCIE Routing and Switching取得。
Copyright © ITmedia, Inc. All Rights Reserved.
大規模DCの課題を解決するネットワーク最新技術
この記事の著者
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
「Excel至上主義」の終わらせ方 丸2日の手作業地獄から情シスと現場を救うには
-
2
急増する「AIはこう言ってる」マン 判断を狂わせる「AI忖度」を防ぐには?
-
3
取手市がVDIと決別した理由 更改費用「4倍超」を約1.7倍に圧縮
-
4
221人調査で分かった「情シス最大のストレス」は?
-
5
「データストレージの活用方法」に関するアンケート
-
6
「AI時代の統合基盤・エンタープライズAI管理」に関するアンケート
-
7
自宅のWi-Fiが「遅い」「途切れる」本当の原因は? Dellが推奨する鉄則
-
8
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
9
本当に安いPCで十分か? “すぐ重くなる”を防ぐノートPC選びの絶対条件
-
10
Claudeの不可視透かしに批判殺到 著作権消失や誤判定に潜む企業リスク
ホワイトペーパーランキング PR
-
1
年収2000万「クラウドセキュリティのプロ」になれる資格とは
-
2
セキュリティソフトをすり抜ける標的型攻撃メール、不審メールの見破り方とは?
-
3
Windows Updateの通信集中で回線が逼迫、ネットワーク刷新事例に学ぶ解決策
-
4
財務を戦略的組織へ進化させるAI活用術、4つの主要な障壁と解消方法
-
5
「NAS」「SAN」「DAS」は何が違う? いまさら聞けないストレージの基礎
-
6
“あのファイル転送”で暗躍するノーウェアランサム
-
7
標的型攻撃メールを見破るには? サンプル文面を例に傾向を解説
-
8
商用利用の安全性を確保し大量のコンテンツを高速で生成する、AI活用の秘訣
-
9
マンガで解説、1日で生成AI環境を構築できるワークショップの中身とは?
-
10
Dark AIが台頭する時代の新発想、「より高度なAIで対抗する」具体的方法とは?
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー