Research Engineer, Privacy and Anonymization
Core
Build privacy and anonymization systems to detect and remove PII, secrets, and sensitive information from raw data for AI training pipelines.
Role type
Research Engineer (Privacy & Anonymization)
Builds
Production pipelines for data privacy protection and anonymization
Domain
AI infrastructure, data privacy, information security
Deliverable
production ML models
Required skills
Python, information extraction, named-entity recognition, classification, LLM-based methods, data pipeline development, privacy risk evaluation, adversarial re-identification testing, schema drift handling
Preferred skills
differential privacy, k-anonymity, secure aggregation, format-preserving encryption, healthcare/finance/security data experience, low-latency ML inference, unstructured problem space ownership
Technologies
Python, LLMs, statistical models, classifiers
Responsibilities
Design transformations for sensitive data detection, develop detection approaches combining rules and models, build production anonymization pipelines, create evaluation frameworks for privacy risk and utility, design robust systems for schema drift, translate privacy requirements into technical policies
Seniority
Mid-Senior, hands-on IC
