Research Lead / Principal Scientist & Manager Post-Training · Alignment · Reinforcement Learning Autodesk AI Lab: London · San Francisco · Toronto · Remote (US/CA/EU)
Core
Leading research strategy to transform foundation models into reliable, aligned systems for high-precision domains like architecture, engineering, and manufacturing using post-training and reinforcement learning.
Role type
Principal Scientist & Manager, Post-Training & Alignment
Builds
Production-ready AI systems for CAD, simulation, and design workflows
Domain
Generative AI, Reinforcement Learning, Foundation Models, Architecture & Engineering
Deliverable
production ML models
Required skills
Reinforcement learning for foundation models, Post-training methods (RLHF, RLAIF, DPO, PPO), Team leadership, Evaluation framework design, Model interpretability, Technical strategy
Preferred skills
Frontier model lab experience, Publication record at top venues, Agentic AI background, Production AI deployment experience
Technologies
RLHF, RLAIF, DPO, PPO, CAD kernels, Physics simulation engines
Responsibilities
Own post-training strategy from RLHF to agentic systems, Develop novel algorithms for model reliability, Design evaluation frameworks for long-horizon reasoning, Manage and mentor a team of AI scientists, Publish research at top-tier venues, Establish model readiness criteria for releases
Seniority
Principal, hands-on IC with team leadership