Data Engineer (GCP Databricks)
Core
Design, build, and maintain large-scale data platforms and pipelines to support AI and clinical decision-making tools in healthcare.
Role type
Senior Data Engineer (Healthcare AI)
Builds
Scalable data pipelines, datasets, and analytical products for AI models and clinical dashboards
Domain
Healthcare technology / Data Engineering
Deliverable
production ML models | product features | dashboards & analysis
Required skills
SQL, Python, Apache Spark, Databricks (Delta Lake, workflows), GCP (BigQuery, Cloud Storage, IAM), relational databases (Oracle/PostgreSQL), data orchestration, data modeling, data governance
Preferred skills
Healthcare data (EHR, hospital systems), HL7 FHIR, clinical terminologies (CID-10, SNOMED CT), Unity Catalog, Delta Live Tables, dbt, Terraform, NLP, data observability (Datadog, Prometheus, Grafana)
Technologies
Google Cloud Platform, Databricks, Apache Spark, Oracle, PostgreSQL, Terraform, dbt
Responsibilities
Design and evolve data architectures on GCP and Databricks; build and maintain scalable data ingestion and transformation pipelines; integrate data from electronic health records and hospital systems; organize structured and unstructured data for AI applications; define data modeling and governance standards; build datasets and analytical products to support predictive models; administer Databricks environments and optimize performance; implement data security and privacy controls; collaborate with data science and clinical teams; monitor data infrastructure and improve pipelines.
Seniority
Senior, hands-on IC