v2.4.2

Metrics

Metrics come from OpenTelemetry auto-instrumentation, CloudWatch Lambda/API Gateway metrics, and service-specific custom metrics.

Sources

SourceExamplesWhere configured
OTel host/process/http instrumentationprocess CPU, memory, HTTP duration/countsOTEL_NODE_ENABLED_INSTRUMENTATIONS in serverless.common.yml
AWS SDK instrumentationDynamoDB, SQS, Lambda client callsOTel Node instrumentation layer
Lambda/API Gateway CloudWatch metricsinvocations, errors, duration, throttles, method metricsprovider.tracing, provider.apiGateway.metrics, Terraform stage settings
Custom metricsleads queue/downstream failure metricsservice handlers such as services/leads/functions/*

Standard Lambda RED

MetricMeaning
aws_lambda_invocationsRequest rate
aws_lambda_errorsError count/rate
aws_lambda_duration_averageLatency
aws_lambda_throttlesThrottle count

Alarms

Per-service CloudWatch alarms are defined in serverless.common.yml and attached by each service's custom.alerts block.

TierUse caseError threshold
alertsCriticalTier-1 services such as leads5 errors / 5 min
alertsImportantHigher-traffic or partner-facing services8 errors / 10 min
alertsStandardDefault service tier20 errors / 10 min

Prod alarms notify PagerDuty and dev+alerts@drive.com.au; non-prod alarm behavior depends on the service's selected alert tier and stage list.

Esc