Critical
First response within 1 hour, 24×7 Production is down or a payments, clinical, or dispatch flow is failing for users. No workaround exists and business impact is active now.
Typical examples: Cluster unreachable, data loss suspected, production deploy failed with no rollback path, security exposure being exploited.
High
First response within 4 business hours A service is degraded, or a significant failure is imminent. A partial workaround exists but carries real risk or cost.
Typical examples: Error rates elevated above SLO, environment provisioning broken, alerts firing continuously, one availability zone unhealthy.
Normal
First response within 1 business day Questions, feature requests, configuration changes, and issues with workable workarounds and limited immediate impact.
Typical examples: How-to questions, roadmap input, non-urgent cost reviews, documentation gaps, planned migrations.