データセンター監視・運用事例 | 株式会社NTCテクノロジー
Case Study: Data Center & Cloud Services

法人向けデータセンターのシステム監視/運用業務

24時間365日、一瞬の停止も許されない企業システムとITインフラを死守する。徹底したミス防止体制と確実なオペレーションが生み出す、圧倒的な信頼品質。

業務の概要と当社の強み

業務概要

お客様が運営される法人顧客向けの先進的なデータセンター、およびクラウド環境。そこで受託・稼働している多種多様なシステム全体の安定稼働を、裏側から強力に守り続けるミッションクリティカルな常時監視・運用業務です。

サーバー、ネットワーク機器、その他各種基盤システムから出力されるアラートを、高度なシステム監視ツールを用いてリアルタイムで捕捉。万が一の障害検知の際には、あらかじめ整備された運用手順に沿って即時かつ正確な「一次措置(復旧コマンド実施等)」を施すとともに、システム主管(エンジニア)へ迅速なエスカレーションを実施します。

日々の定期的な動作確認点検を含め、お客様システムの「稼働率(可用性)向上」と「インフラサービス品質の維持・向上」を徹底的に追求しています。

24/365 システム監視・運用連携フロー

監視ツールが捉えたシグナルを、NTC常駐監視メンバーが司令塔となって処理し、安全・確実にシステム主管へ繋ぎます。

Infrastructure

オンプレ/データセンター

  • サーバー監視
  • NW機器監視
  • 各種システム群
アラート通知
24/365 Non-Stop

NTC 監視運用担当

  • アラート受信・状況確認
  • 手順書に基づく一次措置
  • 定期点検・各種オペ
一次措置 / 連絡
Service Owner

システム主管

  • エスカレーション受付
  • 二次対応・本復旧作業
  • 根本原因の分析・改修

主な業務内容

リアルタイムアラート監視

各種システム状況を監視ツールを用いて常時モニタリング。しきい値超えやプロセス停止によるアラート信号を迅速に検知します。

迅速な一次対応

障害検知後、事前定義されたオペレーション手順書に基づき、再起動やプロセス切り替え等の迅速な初期復旧対応を行います。

正確なエスカレーション

一次措置状況、障害レベル、影響範囲を過不足なくまとめ、迅速にシステム主管部署や関連する保守部門へ連絡・引き継ぎます。

定期点検とオペレーション

指示されたスケジュールに基づき、毎日の稼働点検やバックアップジョブ結果のチェックなどを抜け・漏れなく確実に実行します。

1800日連続

運用品質事故ゼロ継続中

Zero Operation Accidents

徹底的な品質管理体制で、
インフラの絶対的な安定運用に貢献

当データセンター監視プロジェクトでは、「品質管理の徹底」を最優先の行動基準としてチーム全体に定着させています。日々の運用業務におけるヒューマンエラーを防ぐための独自の厳格なミス防止策を構築しました。

手順遵守の徹底と指差し確認

マニュアルの形骸化を防ぐため、日々の朝礼や作業前の手順書チェックを義務付け。

堅牢なダブルチェック体制

重要操作時はオペレーターとレビューワーの二者による相互確認プロセスを厳守。