Szenarioantworten
EventBridge Action wiederholt sich
At-Least-Once annehmen und Target idempotent machen. Current State vor Action validieren und Failed Events in DLQ erhalten.
Configuration-Drift-Event
AWS Config für Compliance Evaluation und Systems Manager Automation für sichere scoped Remediation. Exceptions verhindern Remediation Loops.
Pipeline Failure
Bei Failed Stage/Action Execution starten. Native Service Logs, Artifact Location, Execution Role, Input/Output Config und earliest Failed Event prüfen.
CloudFormation Rollback Failure
Erste Failed Resource finden, externe Ursache korrigieren und supported Rollback Recovery verwenden statt breiter manueller Changes.
ECS Tasks stoppen wiederholt
Stopped Reason, Exit Code, Service Events, Image-Pull Access, Task/Execution Role, Network, Health und Capacity Placement prüfen.
EKS Pod ist Pending
Pod Events, Scheduling Constraints, Resource Requests, Taints, Node Capacity, Quotas, Volumes und Admission/Controller prüfen.
Incident Manager in neuem Account
Nicht annehmen, dass er neu aktiviert werden kann. Seit 7. November 2025 ist Incident Manager für neue Kunden geschlossen. Austauschbaren Incident Layer aus allgemein verfügbaren Event-, Automation-, OpsCenter-, Notification-, Collaboration- und Third-Party-Fähigkeiten verwenden.