監視ダッシュボードは一応用意している。でも実際に障害が起きると、結局はログをgrepしたりサーバーに入って手作業で原因を探し始めてしまう。従来型の監視は「異常を検知する」ところまでしかカバーしておらず、「なぜ起きたのか」を突き止める部分は人力に頼りがちだ。『New Relic実践入門 監視からオブザーバビリティへの変革』は、その調査の部分までツールで支えるオブザーバビリティという考え方を、実際の使い方から学べる本だった。
従来型監視との違いから丁寧に説明してくれる
本書は第1部でまず従来型監視が抱える課題と、オブザーバビリティという考え方がなぜ必要になったのかを整理し、New Relicというプラットフォーム全体像を示してくれる。いきなりツールの操作方法から入るのではなく、なぜこのツールが必要なのかという納得感を持って読み進められる構成だった。
APM・Infrastructure・Logsを一気通貫で使える
第2部ではAPM、Infrastructure、Synthetics、Browser、Mobile、Logsといった各機能の基本的な使い方が扱われていて、アプリケーションからインフラ、ログまでを一つのプラットフォームで横断的に見る感覚が掴めた。バラバラのツールを繋ぎ合わせて監視を作っていた自分にとって、この一気通貫の体験は新鮮だった。
読んでよかったポイント
- APMの章を読んでから、リクエストの遅延がアプリケーションのどの処理で発生しているのかを、コードを一行ずつ追わずに特定できるようになった
- Infrastructureの章がサーバーとコンテナ環境を横断して状態を把握する助けになり、障害調査の初動が速くなった
- 第3部の16のオブザーバビリティ実装パターンが、自社のシステム構成にそのまま当てはめられる実践的な内容だった
- Logsの章を読んでから、ログの検索や相関付けをNew Relic上で完結させられるようになり、複数のツールを行き来する手間が減った
- Syntheticsの章で外形監視の設定を学んだことで、ユーザーが気づく前に異常を検知できる仕組みを構築できた
さらに広げて読むなら
障害対応そのものの体制づくりまで学びたいなら、障害対応が属人化している人へ。初動から再発防止まで体系で整えられる一冊も合わせて読むと、監視の仕組みと対応プロセスの両方が整う。
まとめ
異常に気づくことと、原因を突き止めることは別の能力だ。まずは自社の主要なサービスひとつに絞って、本書のAPMの章の設定を試してみてほしい。