Sr Site Reliability Engineer
Core
Administer, operate, and monitor digital health applications and platforms on Microsoft Azure to ensure 24x7 availability and business continuity.
Role type
Senior Site Reliability Engineer (Cloud Infrastructure)
Builds
Healthcare software applications and platforms hosted on Microsoft Azure
Domain
Healthcare / Cloud Infrastructure
Required skills
Azure administration, disaster recovery planning, business continuity planning, infrastructure monitoring, SLA definition, KPI tracking, infrastructure automation, systems administration (Windows/Linux), scripting (PowerShell/Bash), network security (IPsec, VLANs, VPNs, WAF)
Preferred skills
Azure Administrator certification
Technologies
Microsoft Azure, PowerShell, Bash, Windows, Linux
Responsibilities
Drive strategies for 24x7 service availability and business continuity; Manage and administer Azure resources (VMs, databases, networking); Define and document operating procedures for security and compliance; Manage Disaster Recovery and Business Continuity Planning; Establish infrastructure and application monitoring dashboards; Standardize site metrics and report on KPIs; Work with DevOps to automate provisioning and deployment; Participate in on-call rotation for after-hours support.
