Tunnel Health Alerts(旧称 Magic Tunnel health alerts)を設定すると、IPsec/GRE トンネルの成功した ヘルスチェック の割合が、選択した サービスレベル目標(SLO) を下回ったときに、メール、webhook、PagerDuty で通知を受け取れます。
トンネルヘルスアラートは、アラート対象の各 IPsec/GRE トンネルについて、過去 6 時間に顧客トラフィック(ヘルスチェック用トラフィックを除く)を実際に転送したトンネルのヘルスチェック成功率を監視します。各 IPsec/GRE トンネルで成功すべきヘルスチェックの割合について、SLO しきい値を定義できます。アラート対象の IPsec/GRE トンネルで成功したヘルスチェック数が SLO しきい値を下回ると、アラートが発報されます。
トンネルヘルスアラートが発報されると、メール、webhook、PagerDuty の通知に次のデータが含まれます。
- Cloudflare アカウント名
- Cloudflare アカウント ID
- アラートタイプ
- トンネル名
- トンネル ID
- トンネルステータス
- アラート SLO
- タイムスタンプ
現在、Cloudflare ダッシュボードでは 7 つの SLO しきい値を設定できます。より細かく指定する場合は、API を使います。
トンネルヘルスアラートの SLO しきい値は、アラート対象の各 IPsec/GRE トンネルで成功したヘルスチェックの割合です。
| アラート感度レベル | SLO しきい値 |
|---|---|
| 最小 | 95.0 |
| 非常に低い | 96.0 |
| 低い | 97.0 |
| 中 | 98.0 |
| 高い | 99.0 |
| 非常に高い | 99.5 |
| 最大 | 99.9 |
アラートを受け取るまでの時間は、SLO しきい値に設定した感度レベルによって変わります。感度を高くすると、トンネルの健全性が低下したときに早く通知されますが、短時間または軽微な障害でもアラートが発報されることがあります。感度を低くすると誤報は減りますが、深刻度の低い問題の通知が遅れることがあります。
検出のタイミング自体は感度レベルで変わりません。通知の速さは、トンネルの健全性がどれだけ低下したかと、選んだ感度に依存します。ユースケースに合う値を決めるには、SLO をテストする ことを推奨します。
詳細は Cloudflare がトンネルヘルスアラートを算出する方法 を参照してください。
-
Notifications ページを開きます。
Notifications を開く ↗ -
Add を選択します。
-
Product のドロップダウンメニューから Magic Transit を選択します。
-
Tunnel Health Check Alert > Select を選択して通知を追加します。トンネル単位またはデータセンター単位(ベータ)でアラートを追加できます。
トンネル単位のアラート
- Alert by tunnel を選択します。
- 通知の名前と説明を入力します。
- 通知を受け取る人の webhook またはメールアドレスを追加し、Next を選択します。
- ドロップダウンメニューから Alert Sensitivity Level のしきい値を選択します。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) までの選択肢があります。詳細は Cloudflare がトンネルヘルスアラートを算出する方法 を参照してください。
- Alert interval のドロップダウンメニューで、Cloudflare が重複アラートを送るまでに必要な最短時間を設定します。選択肢は 5 分から 7 日までです。
- 選んだアラート感度レベルを、今後作成するすべての新しいトンネルに自動で適用する場合は、Set as default alert for any new tunnels created in the future を有効にします。
- Next を選択します。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種類(Generic Routing Encapsulation(GRE)、Internet Protocol Security(IPsec)、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選択します。
- アラートの内容を確認します。正しければ Create alert を選択します。
データセンター単位のアラート(ベータ)
- Alert by data center を選択します。
- 通知の名前と説明を入力します。
- 通知を受け取る人の webhook またはメールアドレスを追加し、Next を選択します。
- ドロップダウンメニューから Alert Sensitivity Level のしきい値を選択します。デフォルトは Medium (98.0) です。Minimum (95.0) から Maximum (99.9) までの選択肢があります。詳細は Cloudflare がトンネルヘルスアラートを算出する方法 を参照してください。
- Alert interval のドロップダウンメニューで、Cloudflare が重複アラートを送るまでに必要な最短時間を設定します。選択肢は 5 分から 7 日までです。
- アラートを受け取るデータセンターを選び、Next を選択します。
- アラートを受け取るトンネルを選びます。トンネル名で検索するか、種類(GRE、IPsec、CNI(Cloudflare Network Interconnect))で絞り込めます。Next を選択します。
- アラートの内容を確認します。正しければ Create alert を選択します。
トンネルヘルスアラートを作成するには、POST リクエスト を送信します。SLO 値は 0 から 99.99 の範囲で設定できます。
Required API token permissions
At least one of the following token permissions is required:Notifications WriteAccount Settings Write
curl "https://api.cloudflare.com/client/v4/accounts/$ACCOUNT_ID/alerting/v3/policies" \
--request POST \
--header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
--json '{
"alert_type": "magic_tunnel_health_check_event",
"description": "<DESCRIBE_POLICY>",
"enabled": true,
"filters": {
"slo": [
"99.9"
]
},
"mechanisms": {
"email": [
{
"id": "EMAIL_ADDRESS"
}
]
},
"name": "<DESCRIBE_ALERT>"
}'
{
"result": [
{
"id": "f174e90a-fafe-4643-bbbc-4a0ed4fc8415",
"name": "<POLICY_NAME>",
"description": "<POLICY_DESCRIPTION>",
"enabled": true,
"alert_type": "magic_tunnel_health_check_event",
"mechanisms": {
"email": [
{
"id": "<YOUR_EMAIL>"
}
]
},
"created": "2024-09-11T14:13:29.585658Z",
"modified": "2024-09-11T14:13:29.585658Z",
"conditions": {
"and": [
{
"or": [
{
"<=": [
{
"var": "slo"
},
"99.9"
]
}
]
}
]
},
"filters": {
"slo": ["99.9"]
}
}
],
"success": true,
"errors": [],
"messages": []
}
特定のアラート感度レベルがユースケースに合うかを確認するには、次の手順を実行します。
- 過去 6 時間にアクティブなトラフィックがあるトンネルに対して、特定の感度レベルで アラートを作成します。どのトンネルを選ぶか不明な場合は、ネットワークのリアルタイムおよび過去のデータを Network Analytics で確認してください。
- テスト対象のトンネルを無効にして、ヘルスチェックが 100% 失敗する 状態にします。
- Cloudflare からアラートが届くまでの時間は、選んだ感度によって変わります。