Research Engineer
Core
Research and optimize multimodal generative models (text, image, audio, 3D) to improve generation quality, diversity, controllability, and efficiency for productization.
Role type
Senior IC research engineer (multimodal generative AI)
Builds
Production-ready AI painting, text generation, and video generation models
Domain
Artificial Intelligence / Generative AI / Multimodal Learning
Deliverable
production ML models
Required skills
Computer vision, machine learning, deep learning, GAN, VAE, VQGAN, Diffusion models, ControlNet, LoRA, Text Inversion, CLIP, transformer-based cross-modal models, few-shot learning, algorithm training, performance acceleration
Preferred skills
Publications in top conferences or journals, NLP, hands-on experience in AI-generated content
Technologies
GAN, VAE, VQGAN, Diffusion models, ControlNet, LoRA, Text Inversion, CLIP, ERNIE-ViL
Responsibilities
Conduct algorithm training and optimization for image generation, multi-modal large models, and few-shot learning; resolve algorithm bottlenecks in real business scenarios; address industrial deployment of multimodal generative models
Seniority
Senior, hands-on IC