Data Engineer II, OpsTech Team, OTS Anchor Team
Core
Build scalable data platforms and pipelines to power analytics, machine learning, and AI-driven experiences for Amazon's global fulfillment and operational networks.
Role type
Senior IC data engineer (infrastructure & pipelines)
Builds
production ML models | product features | dashboards & analysis
Domain
Retail / Logistics / Data Engineering
Deliverable
production ML models
Required skills
Python, ETL/ELT, data modeling, warehousing, batch and streaming architectures, automated data quality, observability, semantic modeling
Preferred skills
AWS technologies (Redshift, S3, Glue, EMR, Kinesis, Lambda), non-relational databases, full software development life cycle best practices
Technologies
Python, AWS Redshift, AWS S3, AWS Glue, AWS EMR, AWS Kinesis, AWS FireHose, AWS Lambda, AWS IAM, object storage, document stores, key-value stores, graph databases, column-family databases
Responsibilities
Design high-performance data pipelines and architectures; create reusable datasets and data products; build feature pipelines and training datasets for ML; improve platform reliability through automated quality and anomaly detection; design semantic models and metrics; partner with data scientists and operations teams to deliver business impact.
Seniority
Senior, hands-on IC