🇺🇸 Data Engineer, Remote - Full Time
Core
Build and scale data infrastructure to support AI-driven products and research initiatives.
Role type
Senior Data Engineer (AI/ML support)
Builds
Distributed data pipelines, large-scale datasets, and cloud-native data systems
Domain
Cloud data engineering supporting AI/ML research
Deliverable
production ML models
Required skills
Python, SQL, Apache Spark, AWS, distributed data processing, NoSQL databases, data partitioning, performance optimization
Preferred skills
AI/ML workflows, LLM data workflows, data visualization (Matplotlib, Seaborn, Plotly)
Technologies
Apache Spark, AWS, SQL, NoSQL, Python
Responsibilities
Design and maintain scalable data pipelines for large-scale data ingestion and transformation; Develop and optimize distributed data processing workflows; Build and maintain data storage solutions across SQL and NoSQL systems; Design and implement data architectures on AWS for high-volume data operations; Write efficient code to extract, transform, validate, and analyze large datasets; Ensure data quality, integrity, and operational reliability; Collaborate with AI researchers and data scientists to support data-intensive applications; Implement automation, orchestration, and monitoring workflows.
Seniority
Senior, hands-on IC