微信输入法- 语音识别大模型算法研究员/工程师
Core
Research and development of large-scale speech recognition models to enhance robustness under complex acoustic conditions (noise, low volume, far-field, accents, dialects) and multimodal speech-text models integrating domain knowledge and user behavior.
Role type
Senior IC machine-learning researcher/engineer (speech recognition & large language models)
Builds
Production speech recognition models and multimodal speech-text systems
Domain
Consumer technology / Speech AI / Large Language Models
Deliverable
production ML models
Required skills
Speech recognition, Speech synthesis, Multimodal learning, Large language models (pre-training, fine-tuning, RL), Python, C/C++, PyTorch, DeepSpeed, Mathematical foundations, Signal processing
Preferred skills
Publications in top-tier conferences (NeurIPS, ICLR, ICML, ACL, CVPR, ICASSP, INTERSPEECH), Research innovation, Problem decomposition
Technologies
PyTorch, DeepSpeed
Responsibilities
Develop large-scale speech recognition models for complex acoustic scenarios; Research multimodal speech-text models with context modeling and reasoning capabilities; Manage pre-training, post-training, and reinforcement learning data and algorithms.