Sr Engineering Program Manager, Evaluation - Special Projects
Core
Lead Apple's AI evaluation framework to measure and validate multi-modal model performance, translating product requirements into success metrics.
Role type
Senior Engineering Program Manager (AI Evaluation)
Builds
Evaluation methodology, success metrics, and validation pipelines for next-generation AI models
Domain
Artificial Intelligence / Machine Learning
Deliverable
production ML models
Required skills
Technical program management, strategic leadership, cross-functional coordination, executive communication, ambiguity navigation, data collection orchestration, simulation infrastructure management, process improvement
Preferred skills
Large language models (LLMs), vision-language models (VLMs), multi-modal architectures, reinforcement learning from human feedback (RLHF), preference optimization, statistical analysis, A/B testing, experimental design
Technologies
LLMs, VLMs, multi-modal architectures, RLHF
Responsibilities
Define and drive evaluation strategy for AI models, align frameworks with product vision, develop programs to validate multi-modal model performance, orchestrate data collection and evaluation pipelines, coordinate distributed teams across functions, communicate program status to executive leadership
Seniority
Senior, hands-on IC with strategic influence