Research Engineer - Audio & Speech Models
Core
Building next-generation open-source audio models including autoencoders, ASR, TTS, SSL, and speech-to-speech.
Role type
Research Engineer (Audio & Speech Models)
Builds
Open-source audio models and training pipelines
Domain
Audio AI, Speech Processing, Machine Learning
Deliverable
production ML models
Required skills
Audio model training intuition, PyTorch, Python, large-scale GPU cluster training, experimental methodology, signal processing, diffusion/consistency/GAN models, codebase contribution
Preferred skills
Published ML research, postgraduate degree in CS/EE/Math/Physics/ML
Technologies
PyTorch, Python
Responsibilities
Design novel architectures and training methodologies, manage large-scale audio training runs, optimize training stack performance, collect and process audio datasets
Seniority
Mid-Senior, hands-on IC
Sourced via ashby · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.