Staff Site Reliability Engineer
Core
Architect long-term vision for AWS cloud ecosystem, global observability, and container orchestration to ensure reliability and scalability for a global healthcare platform.
Role type
Staff Site Reliability Engineer (Cloud Architecture & Platform Strategy)
Builds
Fault-tolerant, cost-effective AWS architectures; global observability standards; optimized CI/CD pipelines; secure Kubernetes environments.
Domain
Healthcare / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
AWS stack mastery, Kubernetes, Infrastructure as Code (Terraform/Ansible), Python/Bash scripting, incident management, technical leadership
Preferred skills
Event-driven architectures, complex data warehouses, open-source contributions, industry speaking
Technologies
AWS (EC2, Lambda, RDS, S3), DataDog, Jenkins, Kubernetes, Terraform, Ansible, Kafka, Kinesis, Redshift
Responsibilities
Design fault-tolerant cloud architectures; architect global observability standards; optimize CI/CD philosophy; lead Kubernetes efficiency and security efforts; partner on strategic security compliance; serve as escalation point for complex system failures; mentor senior engineers and lead cross-functional initiatives.
Seniority
Staff, high-level influence & mentorship