Data Engineer II, Data & Analytics
Core
Build and maintain enterprise data platforms, pipelines, and AI/LLM solutions to support business analytics and decision-making.
Role type
Senior Data Engineer (Cloud & AI)
Builds
Production-grade data lakes, data warehouses, and AI-powered data products/APIs for enterprise functions.
Domain
Healthcare (Pharmaceuticals) / Cloud Data Engineering / Generative AI
Deliverable
production ML models | product features | infrastructure
Required skills
Python, PySpark, SQL, AWS (Glue, Athena, Redshift, Postgres), Databricks, Delta Lake, RESTful API design, Vector databases (pgvector, Pinecone, OpenSearch), LLM API integration, RAG pipelines, Orchestration (LangChain, LlamaIndex)
Preferred skills
Cloudera Data Platform (CDP), FastAPI/Flask/Django, OAuth 2.0/JWT/RBAC, Prompt engineering
Technologies
AWS, Databricks, Delta Lake, Glue, Athena, Redshift, Postgres, Pinecone, OpenSearch, LangChain, LlamaIndex, FastAPI, Flask, Django
Responsibilities
Design and develop ETL/ELT pipelines and lakehouse architectures; Build and optimize data models for reporting and analysis; Develop and maintain RESTful APIs to expose data and AI capabilities; Integrate LLM APIs and build RAG pipelines for enterprise workflows; Implement data governance policies and security protocols; Collaborate with stakeholders to define data product strategy.
Seniority
Mid-Senior, hands-on IC