Zum Hauptinhalt springen

Szenarioantworten

EventBridge Action wiederholt sich

At-Least-Once annehmen und Target idempotent machen. Current State vor Action validieren und Failed Events in DLQ erhalten.

Configuration-Drift-Event

AWS Config für Compliance Evaluation und Systems Manager Automation für sichere scoped Remediation. Exceptions verhindern Remediation Loops.

Pipeline Failure

Bei Failed Stage/Action Execution starten. Native Service Logs, Artifact Location, Execution Role, Input/Output Config und earliest Failed Event prüfen.

CloudFormation Rollback Failure

Erste Failed Resource finden, externe Ursache korrigieren und supported Rollback Recovery verwenden statt breiter manueller Changes.

ECS Tasks stoppen wiederholt

Stopped Reason, Exit Code, Service Events, Image-Pull Access, Task/Execution Role, Network, Health und Capacity Placement prüfen.

EKS Pod ist Pending

Pod Events, Scheduling Constraints, Resource Requests, Taints, Node Capacity, Quotas, Volumes und Admission/Controller prüfen.

Incident Manager in neuem Account

Nicht annehmen, dass er neu aktiviert werden kann. Seit 7. November 2025 ist Incident Manager für neue Kunden geschlossen. Austauschbaren Incident Layer aus allgemein verfügbaren Event-, Automation-, OpsCenter-, Notification-, Collaboration- und Third-Party-Fähigkeiten verwenden.