
Senior Site Reliability Engineer
Operate and administer AWS accounts and serverless services (Lambda, SQS, EventBridge, CloudWatch, S3); own PostgreSQL and other data store administration, backup/recovery, and disaster recovery testing. Maintain infrastructure as code (SST/Pulumi), implement monitoring and alerting, lead incident response and on-call rotations, and continuously improve deployability, scalability, and cost visibility.