ありがちな原因を整理
バックアップが失敗する4つの原因と解決策
システムを守るためのバックアップが失敗していたら致命的だ。確実にバックアップを取得するために、失敗の要因を低減しておこう。
スナップショットやレプリケーションからクラウドへのコピーに至るまで、データ保護にはさまざまな方法がある。にもかかわらず、IT部門が基盤とするのはバックアップだ。
スナップショット、レプリケーションその他のどのような方法でも、破損したデータはそのままコピーされる。そのため、ロールバックには可能な限りさかのぼれるバックアップが必要になる。
だがバックアップも失敗する。最新の調査によると障害発生率は37%と、驚くほど高い。
バックアップの失敗にはさまざまな理由がある。本稿はその要因を調査する。HDD故障などの予期できない障害や明確に回避できない障害もあるが、これらを軽減することは可能だ。パッチ適用後や構成変更後に発生する問題など、予想が可能な障害もある。
バックアップの正しい設定やバックアップソフトウェアの仕組みの理解など、人的要素も関係する。
メディアの障害
ハードウェアは故障する可能性がある。HDDは年間で100分の1が動作不良を起こすといわれているが、障害発生は予期できない。これはRAIDなどの冗長性によって軽減できる。
SSDでも障害は発生するが、HDDよりも発生率は低い。ただしSSDは寿命が限られている。ここでもハードウェアの冗長性と交換を運用に組み込むことが重要だ。
テープで障害が起きるメカニズムは独特だ。テープの保持とメンテナンスに関するメーカーの指示に従い、メディア特性に注意しなければならない。読み取りヘッドとメディアは摩耗する可能性があり、それは別の装置に復元するまで分からないことがある。
バックアップに影響するハードウェア障害を回避する重要なポイントは、3-2-1バックアップなどによって冗長性を持たせることだ。
ソフトウェアの問題
ソフトウェアには多種多様な問題がある。バックアップ失敗の最も一般的な原因の一つは、アップグレードやパッチによる変更が問題を引き起こすことだ。ソフトウェアに多数の変更が生じると、バックアップ構成の互換性が失われることがある。
この問題の主な軽減方法は、実行される更新を認識し、バックアップの中断を招く可能性がある種類と場所に対する備えを怠らないことだ。ソフトウェアで発生する恐れのある問題の予測に役立つ分析プラットフォームを提供するサプライヤーもある。
バックアップソフトウェア自体でエラーが発生することもある。これには
- アプリケーションの実行失敗に関係するサービス
- 正しくインストールされていないエージェント
- 接続の問題
- リード/ライトエラー
- バックアップ期間に影響するサマータイムへの変更
など、さまざまな問題が関係する。ここではサプライヤーのサポートリソースの確認が必要だ。
仮想化環境は、仮想化固有の問題を引き起こすことがある。仮想マシンとそのデータの作成、移行、廃棄には必然的に多くの変更を伴う。バックアップソフトウェアは非常に複雑な状況を追跡しなければならない。
バックアップに関係する障害は、
- カタログの破損
- 不十分なアクセス許可
- ボリュームシャドウコピーサービスの障害
- 仮想HDD(VHD)の損傷
などが原因になる可能性がある。
コンテナによってライフサイクルが急速に変化すると、独特の複雑さがもたらされるかもしれない。
人為的ミス
どんなに自動化が進んでも、バックアップのデプロイと運用を監視するのは人間の責任であることは変わらない。そのため人為的ミスが起きる可能性がある。重要なのは、人為的ミスがバックアップに影響する要素を減らすことだ。
出発点はバックアップの構成、バックアップ製品の知識、タスクの自動化に役立つツールだ。正しく構成してデータセット、アプリケーション、サービス、その他の依存関係の検出方法を理解することがバックアップを成功させる鍵となる。もっと重要なのは、これが復元を成功させる鍵にもなることだ。
いずれにせよ、単一のファイルであれシステム全体であれ、データを復元できなければ意味がない。データを復元する場合、依存関係が保護され、復元可能であることを確認する必要がある。
この点でもサプライヤーが検出ルールを用意している可能性がある。ただし、依存関係を検出できないツールがあることに注意しなければならない。
人為的エラーに備える主な方法は、定期テストを実施してポリシーと手続きを構築し、コンピュータが対処できないギャップを擦り抜ける可能性に対応することだ。
インフラの障害
バックアップはあらゆる種類のインフラを横断する。インフラのどこかで発生した障害はバックアップと復旧に影響する。特に復旧の場合は脆弱(ぜいじゃく)になる可能性がある。
インフラにはテープドライブとテープライブラリ、ディスクアレイ、バックアップサーバ、ネットワークなどが含まれる。最近はクラウドへのリンクも増えている。
インフラの問題を削減する鍵は冗長性だ。
WAN接続、クラウドリソースなど、直接管理できないインフラについてはSLA(サービスレベル契約)を設定する必要がある。災害発生時に作業できるインフラが整っていることも確認する。
コロナ禍以降、テレワークをサポートする必要性が大幅に高まったことでインフラの問題が浮き彫りになるだろう。エッジデバイスをバックアップする機能があることを確認し、場合によってはこのタスクに特化した製品を調達する必要がある。
Copyright © ITmedia, Inc. All Rights Reserved.
Computer Weekly日本語版
この記事の著者
関連記事
新着ホワイトペーパー PR
-
製品資料
[o9ソリューションズ・ジャパン株式会社] 「改正物流効率化法対策」徹底解説 総物流費を抑制するサプライチェーン戦略 -
製品資料
[o9ソリューションズ・ジャパン株式会社] 「サプライチェーン最適化」実践ガイド:効果的な意思決定を実現する秘訣とは? -
製品資料
[株式会社リンプレス] 非デジタル/IT人材を「自走するDX推進者」に変えるための育成ロードマップ -
市場調査・トレンド
[ワンアイルコンサルティング株式会社] AI時代の組織設計:「判断と責任」を人に残すための2つの原則とは? -
技術文書・技術解説
[ワンアイルコンサルティング株式会社] システムの保守がモダン化を阻む? 「変えない判断」から脱却する方法とは
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
1200万円のSaaS導入を回避 スギ薬局「運用費10万円」のAIエージェント構築術
-
2
「完璧な設計」なのに3000万円溶けた AWSの失敗事例から学ぶ3つの教訓
-
3
100億円の「Linux更新」を回避 みずほ銀行が選んだ“おきて破り”のRHEL延命策
-
4
高額な「AI PC」を一般従業員も使えたら? 費用のハードルを一気に下げる方法
-
5
LLMの「過学習」、正しく説明している文章はどれ?
-
6
「AIバブル」は崩壊するのか? 熱狂の後に来る“尻拭い”と4つの防衛策
-
7
「コピペ運用の限界」に直面するAI活用 7割超が“別画面”のまま使う理由は?
-
8
2035年までに1億4500万台、急拡大する「フィジカルAI」市場の勝者は誰か
-
9
IT調達担当者が知るべき「IT機器 大インフレ時代の前向きな選択肢」
-
10
【基本情報技術者試験】「デュプレックスシステム」と「デュアルシステム」の違いは?
ホワイトペーパーランキング PR
-
1
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
2
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
3
Windows PCとMacの選択制で生産性向上 LINEヤフーが実践する運用管理方法とは
-
4
DX/AI投資の壁を突破、現代の最高財務責任者が直面する課題と克服のヒント
-
5
「Google Workspace」活用事例34選、先進の生成AIによる組織変革の全貌
-
6
生成AIで文書活用を進めるには? 効率化と安全性をどう両立する
-
7
「人員を増やす」という選択肢はない 情シスが負の連鎖から抜け出すには?
-
8
「問題が深刻化しやすいプロジェクト管理」から脱却する方法とは?
-
9
Linuxのスキルを証明する“激推し”の認定資格はこれだ
-
10
NTTドコモが実践したクラウド統合監視 業務量2倍でも残業削減を実現できた理由
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー