Site Reliability Engineer
Core
Architect, build, and operate reliable, scalable, secure cloud infrastructure supporting Autodesk's SaaS web applications and products.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Hosting solutions, global cloud environments, containerized applications, and automated operational processes for SaaS products.
Domain
Cloud Infrastructure / DevOps / SaaS
Required skills
Linux administration, AWS services (EC2, ECS, EKS, Lambda, ELB, S3, IAM, VPC, DynamoDB, RDS), Docker, Kubernetes, Infrastructure as Code (Terraform, CloudFormation), CI/CD (Jenkins, Artifactory, Git), scripting (Bash, Python, Perl), observability (CloudWatch, Splunk, Dynatrace, New Relic, Grafana), SQL (MySQL, PostgreSQL, SQL Server), incident management, SLO/SLI definition, capacity planning.
Preferred skills
AI-assisted engineering tools, distributed cloud-native system design, cloud security and compliance, global team collaboration.
Technologies
AWS, Docker, Kubernetes, Terraform, CloudFormation, Jenkins, JFrog Artifactory, Git, CloudWatch, Splunk, Dynatrace, New Relic, Grafana, Bash, Python, Perl, MySQL, PostgreSQL, SQL Server
Responsibilities
Architect hosting solutions for SaaS applications; design and maintain IaC solutions; implement security best practices and system hardening; automate operational processes; define and monitor SLOs/SLIs; manage on-call support and incident resolution; conduct post-incident reviews; collaborate with Dev, QA, and Documentation teams.
Seniority
Senior, hands-on IC