Grafana OSSからGrafana Cloud IRMにアラートを送信する方法

Grafana OSSからGrafana Cloud IRMにアラートを送信する方法

2026-10-13•1 min
Twitter
Facebook
LinkedIn

英文記事公開日: 2025年6月4日

2025年3月に、Grafana OnCall(OSS)がメンテナンスモードに移行したことを発表しました。一方、OnCallの開発は、Grafana Cloud上で提供されるGrafana Cloud IRMとして継続されており、オンコール管理とインシデント対応を一つのソリューションに統合しています。

この発表を受け、多くのユーザーから、Grafanaのセルフホストを続け、Grafana Alertingで問題を早期に検出しつつ、インシデントのエスカレーションや管理にはインシデントレスポンス管理(IRM)ソリューションを活用したいという声が寄せられています。

Grafana Cloudのサービスは、Grafana Cloud上でGrafanaを稼働させている場合にしか使えないと思われるかもしれません。実際には、セルフホスト環境のGrafana(OSSまたはEnterprise)からもGrafana Cloud IRMに接続できます。

Grafana Cloudの無料プランでは、アクティブユーザー3名までIRMを利用できるので、今すぐお試しいただけます。

IRMソリューションでアラートを処理する理由

アラートはオブザーバビリティ(可観測性)における最初の防衛ラインです。何かが問題になりかけているとき、アラートシステムは次の2つのことを行う必要があります。

  1. 何かが問題であることを検出する。
  2. 適切な担当者に通知する。

Grafana Alertingは通知面で豊富な選択肢を提供しています。Slack、Microsoft Teams、メール、PagerDuty、Amazon SNS、Jira、Webhook、Grafana Cloud IRMなど多数のチャンネルにアラートを送信できます。これらのチャンネルをコンタクトポイントと呼びます。

しかし、アラートを送信するだけでは十分ではありません。

特に業務時間外に本番のインシデントが発生したとき、Slackへの通知だけでは対処しきれません。明確なオーナーシップ、エスカレーションパス、オンコールスケジュール、そしてレスポンスを調整するためのプロセス—つまり「仕組み」が必要です。

まさにそのために設計されたのがGrafana Cloud IRMです。チームのプロセスをサポートし、構造化するための主要な機能を提供します。

  • オンコールスケジューリング: ローテーションシフト、引き継ぎ、時間ベースのエスカレーションロジックを定義します。
  • エスカレーションチェーン: 社内のカスタムポリシーに基づいてアラートをルーティングします。
  • マルチチャンネルページング: 電話やモバイルアプリなど緊急チャンネルでレスポンダーに通知します。
  • インシデントトラッキング: 既存のアラートとダッシュボードにインシデントを紐付けます。
  • サービスオーナーシップモデル: 個々のユーザーだけでなく、サービス・チーム・オーナーにアラートを紐付けます。
  • ポストモーテム機能: インシデント後にタイムライン、レスポンダー、アクションをレビューして学びます。

インテグレーションの仕組み

大まかに言うと、Grafana OSS(またはGrafana Enterprise)はWebhookエンドポイント経由でGrafana Cloud IRMにアラート通知を送信します。

Grafana Alerting to Grafana Cloud IRM workflow

設定は簡単です。

  1. Grafana Cloud IRMインスタンスで、アラートを受信するAlertmanagerインテグレーションを設定します。
  2. ホストしているGrafana Alertingインスタンスで、IRMインテグレーションエンドポイントを使ったWebhookコンタクトポイントを設定します。

※この動画では設定方法とインテグレーションのテストを実演しています。

Video

インテグレーションはすぐに使い始めることができます。Grafana Cloud IRMはGrafana Alertingが使用するデフォルトのWebhookフォーマットを認識しているため、カスタムペイロード、テンプレート、プロキシは不要です。

アラートはローカルのGrafanaからGrafana Cloud IRMへの一方向にのみ流れます。逆方向には流れません。ダッシュボード、アラートルール、アラート評価はすべてローカルのGrafanaインスタンスに残り、インシデントレスポンスだけをその目的に特化したツールに委ねる形です。

チームへのページングが必要なアラートを設定する

アラートは実際の問題を示し、対応可能なものであるべきですが、すべてのアラートが深夜3時に誰かを起こす必要はありません。

Grafana Cloud IRMは、エスカレーションチェーンとルーティングテンプレートを使ってアラートとインシデントを柔軟に処理できます。また、「Default」と「Important」の2種類の通知タイプをサポートしており、IRMユーザーごとに別々の通知設定を構成できます。

アラートの中には、即時対応が不要な一時的な問題や重要度の低い状態を示すものもあります。一方、調整された対応が必要な実際の本番問題を示すものもあります。Grafana Cloud IRMは後者のために設計されています。

すべてをGrafana Cloud IRMに接続する前に、どのアラートルールが実際にチームへのページングが必要かを検討しましょう。優先度の低いアラートをエスカレーションチェーンから除外することで、オンコールエンジニアが集中力を維持できます。

エスカレーションが必要なアラートを特定したら、Grafana AlertingでGrafana Cloud IRMにアラートを転送する方法は2つあります。

  1. アラートルールの設定で、IRMのWebhookコンタクトポイントを直接選択する。これは、特定のルールをIRMインテグレーションに結びつける最もシンプルな方法です。
  2. severity、service、teamなどのラベルに基づいてアラートをルーティングする通知ポリシーを使用する。この方法はより柔軟性が高く、アラート設定のスケールアップに役立ちます。

ハートビートによるインシデントパイプラインの監視

Grafanaを稼働させていると、すべてが正常に動作していると思いがちです。では、正常に動作しなくなったらどうでしょうか?

Grafanaをホストするには一定の運用オーバーヘッドが伴い、信頼性の高いオブザーバビリティスタックを構築する一環として、ダウンタイムや問題への備えも必要です。Grafanaインスタンスがダウンすると、アラートルールの実行が止まり、重要なアラートに迅速に対応できなくなる可能性があります。

Grafana Cloud IRMのハートビートモニタリングはこうした状況に対処するために役立ちます。アラートが沈黙する前に、以下の設定を行うことでアラートワークフローの障害を検知できます。

Grafana Cloud IRMが定義した期間内にアラートを受信しなかった場合、自動的にインシデントを作成します。Grafana Cloud IRMは、指定した時間内にアラートを受信しなかった場合、自動的にインシデントを作成します。たとえば、ハートビートで10分ごとにアラートの受信を確認するよう設定した場合、5分ごとに発火する「ダミー」のアラートを作成し、定期的にアラートが届くことを確認します。

ここでモニタリングしているのはサービスではなく、アラートからインシデントへのパイプライン自体です。

ハートビートモニタリングの設定方法:

  1. IRMのAlertmanagerインテグレーションで、ハートビートモニタリングを有効にします。
  2. 受信アラートの期待頻度を設定します(例:5分または10分ごと)。
  3. ホストしているGrafanaインスタンスで、ハートビート頻度より短い間隔で継続的に発火するアラートルールを作成します。

手順の詳細については、ドキュメントを参照ください。

まとめ

Grafana OSSとGrafana EnterpriseはGrafana Cloud IRMと連携できます。

Grafana AlertingとGrafana Cloud IRMは補完的なソリューションです。Grafana Cloud IRMのインシデントレスポンス機能を活用するために、Cloudに完全に移行する必要はありません。Webhookインテグレーションを設定し、適切なアラートをルーティングするだけで、Grafana Cloud IRMがカスタムエスカレーションチェーンを通じてチームの調整を担います。

設定の詳細については、Grafana OSSとGrafana Cloud IRMの設定ドキュメントを参照ください。

Grafana Cloudは、メトリクス、ログ、トレース、ダッシュボードなど、オブザーバビリティをすぐに始められる最も手軽な方法です。充実した無料プランと、あらゆるユースケースに対応したプランを用意しています。今すぐ無料で登録する

Tags