大语言模型强化学习算法工程师 - Seed Model
Core
Developing and optimizing large language models (LLMs) and seed models for applications in generation, reasoning, and code synthesis.
Role type
Senior IC reinforcement learning algorithm engineer (LLM)
Builds
Production LLMs and seed models for consumer apps (e.g., Doubao) and enterprise clients via Volcano Engine.
Domain
Artificial Intelligence / Large Language Models / Reinforcement Learning
Deliverable
production ML models
Required skills
C/C++ or Python, data structures and algorithms, NLP algorithms, computer vision algorithms, large model training, reinforcement learning algorithms
Preferred skills
research publications in NLP/CV, leading influential LLM projects, deep system optimization for large models
Responsibilities
Discover and apply simple, universal ideas to optimize models across scales; explore boundaries of ultra-large models and perform deep system optimization; advance data construction, instruction fine-tuning, preference alignment, and model optimization; implement applications in generation, reasoning, and code generation; research and expand future use cases for models.