Data Scientist III
Core
Design, develop, and evolve scalable data pipelines and products for validating Generative AI solutions, ensuring data quality, governance, and performance for RAG applications.
Role type
Senior Data Scientist (Generative AI & Data Engineering)
Builds
Scalable data pipelines, validation products for Generative AI, and RAG solutions
Domain
Financial Services / Generative AI / Data Engineering
Deliverable
production ML models | product features
Required skills
Python, SQL, PySpark, Apache Spark, Databricks, Cloud platforms, DataOps, MLOps, LLMOps, Data Governance, Vector Database management
Preferred skills
English (conversational), Certifications
Technologies
Databricks, Apache Spark, Python, SQL, PySpark, Cloud, Vector Databases
Responsibilities
Design and develop scalable data pipelines for Generative AI validation; Validate ETL/ELT pipelines for batch and streaming; Evaluate data preparation practices for RAG (chunking, embeddings, indexing); Analyze DataOps, MLOps, and LLMOps practices; Ensure data quality, governance, security, and observability; Diagnose and resolve critical incidents and optimize performance/costs.
Seniority
Senior, hands-on IC