Machine Learning Scientist
Core
Building and optimizing diffusion or flow-matching models for real-time speech and audio generation in multimodal AI systems.
Role type
Senior IC machine learning scientist (generative audio/speech)
Builds
Production-ready generative models for AI character voices and interactions
Domain
Generative AI, Speech & Audio, Multimodal Systems
Deliverable
production ML models
Required skills
Diffusion models, Flow-matching models, Large-scale model training (3B+ parameters), Distributed systems, Model distillation, Streaming model optimization, Architecture design, Evaluation system design
Preferred skills
Audio or speech generation, Publications in generative AI, Open-source contributions
Technologies
Diffusion models, Flow-matching, Distributed training systems
Responsibilities
Design and train large-scale diffusion or flow-matching models, Develop novel architectures and training techniques, Build evaluation systems for generation quality, Perform low-level performance optimizations and high-level model design
Seniority
Senior, hands-on IC