Text To Speech (TTS) Algorithm Engineer(J93901)
Core
Develop and optimize large-scale Text To Speech (TTS) models for Baidu's overseas products, focusing on model structure optimization, pre-training, and fine-tuning.
Role type
Machine Learning Engineer (Speech Synthesis)
Builds
Production TTS models for voice communication products
Domain
Artificial Intelligence / Speech Processing
Deliverable
production ML models
Required skills
Deep learning frameworks (PyTorch), Linux, Python, Speech synthesis, Signal processing, Model optimization
Preferred skills
Academic publications (Interspeech, ICASSP), Speech competition awards
Responsibilities
Optimize TTS model performance, Develop large-scale TTS models, Follow up on cutting-edge voice communication technologies
Seniority
Mid-level, hands-on IC
Sourced via baidu · Listed on CareerPlan, which tracks 845,000+ jobs from 20+ sources.