Large Model Application Algorithm Research Scientist-International Content Security Algorithm Research
Core
Researching and developing large language models (LLMs) to enhance reasoning capabilities, specifically focusing on reinforcement learning (RL) and reward model design for natural language tasks.
Role type
Senior IC research scientist (large model reasoning)
Builds
Large language models with improved reasoning abilities for content moderation, search, and recommendation scenarios
Domain
Artificial Intelligence / Natural Language Processing / Large Models
Deliverable
production ML models
Required skills
Reinforcement Learning, Reward Model Design, Large Language Models, Chain-of-Thought reasoning, Natural Language Processing, Python, C++, Research Publications, Data Mining
Preferred skills
Experience with Process-based Reward Models, Monte Carlo Tree Search, Knowledge Distillation, Long Chain-of-Thought techniques, Open-source contributions to large models
Responsibilities
Design effective reward models for RL processes to guide iterative reasoning improvement
Seniority
Senior, hands-on IC
