CareerPlanSign in

Research Engineer - Audio & Speech Models

San Francisco💼 Full-time🗓 2026-03-17 → 2026-09-26

Core

Building next-generation open-source audio models including autoencoders, ASR, TTS, SSL, and speech-to-speech.

Role type

Research Engineer (Audio & Speech Models)

Builds

Open-source audio models and training pipelines

Domain

Audio AI, Speech Processing, Machine Learning

Deliverable

production ML models

Required skills

Audio model training intuition, PyTorch, Python, large-scale GPU cluster training, experimental methodology, signal processing, diffusion/consistency/GAN models, codebase contribution

Preferred skills

Published ML research, postgraduate degree in CS/EE/Math/Physics/ML

Technologies

PyTorch, Python

Responsibilities

Design novel architectures and training methodologies, manage large-scale audio training runs, optimize training stack performance, collect and process audio datasets

Seniority

Mid-Senior, hands-on IC

Sourced via ashby · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.