强化学习算法工程师-Data AML
Core
Designing and training LLM/VLM agents for ad creative generation using reinforcement learning and end-to-end training methods.
Role type
Senior IC reinforcement learning algorithm engineer (AIGC/Agents)
Builds
Multimodal creative generation agents for advertising
Domain
Advertising, Large Language Models, Reinforcement Learning
Deliverable
production ML models
Required skills
Reinforcement learning algorithms, LLM/VLM training, Agentic RL, End-to-end training, Reward design, Probability theory, Deep learning
Preferred skills
AIGC project experience, Top-tier conference publications (NeurIPS/ICML/ICLR/ACL/EMNLP), Competitive programming awards (ACM/ICPC/NOI/IOI/Top Coder/Kaggle), Leading influential projects
Technologies
LLM frameworks, VLM frameworks, RL libraries, Python
Responsibilities
Mining and cleaning high-quality data for sample generation, Designing confident RL reward schemes, Researching and implementing RL algorithms for LLM/VLM agents, Developing ad creative generation agents, Tracking and applying latest LLM/VLM/Agent technologies
Seniority
Senior, hands-on IC