Research Product Manager, Fine-tuning
Core
Owns the roadmap and delivery of fine-tuned Lila model variants, deciding on scientific domain capabilities (RL environments + SFT data) and prioritizing them against Target Product Profiles and customer needs.
Role type
Research Product Manager (LLM fine-tuning & RL)
Builds
Fine-tuned Lila model variants for platform and commercial use cases
Domain
AI/ML, Large Language Models, Scientific Superintelligence
Deliverable
production ML models
Required skills
Product management for ML/AI products, backlog prioritization under competing scientific/commercial demands, cross-functional partnership with research teams, translating ambiguous priorities into sequenced deliverables, defining data/evals/release criteria
Preferred skills
Experience with LLM training/fine-tuning/RL-based capability development, partnering with ML research teams on eval design, background in scientific/technical domains
Technologies
Lila model, RL environments, SFT data
Responsibilities
Own and maintain the prioritized backlog of training-capability packages; define required training data, strategic data gaps, evals, and release criteria for fine-tuned variants; coordinate handoff of validated fine-tunes to app and platform teams; integrate into AI Research sprint planning to track delivery and unblock dependencies; define and track release/acceptance criteria for new capabilities
Seniority
Mid-to-Senior, hands-on IC
