Principal Data Architect II, Biotherapeutics and Genetic Medicine
Core
Design and own the architecture for a scalable, cloud-native data platform enabling predictive and generative AI/ML solutions in biotherapeutic and genetic medicine discovery workflows.
Role type
Principal Data Architect (Individual Contributor)
Builds
Cloud-native data platforms connecting laboratory data across dozens of assays for scientific, operational, and machine learning use.
Domain
Biotherapeutics and Genetic Medicine (Pharmaceutical/Biotech)
Deliverable
production ML models
Required skills
Data modeling, data integration, data storage solutions, data pipelines, AI/ML integration, SQL, Python, Java, cloud data infrastructure design, FAIR data practices, data governance
Preferred skills
Leading cross-functional technical teams, working in large cross-functional R&D environments
Technologies
AWS, Azure, GCP
Responsibilities
Define and drive architecture for scalable cloud-native data platforms; Design data models and integration patterns connecting datasets across lab groups; Partner with wet lab scientists and automation engineers to maximize data value; Work with data scientists to ensure pipelines support model development and production deployment; Advance FAIR data practices and data stewardship; Champion connected data and cloud-first principles; Partner with governance experts to implement data policies; Align initiatives with broader corporate efforts; Communicate platform impact via user stories and KPIs.
Seniority
Principal, technical leadership with potential for people management