数据科学家(数据开发工程)-国际化数据生产平台
Core
Design, build, and optimize scalable data pipelines and infrastructure to support high-volume data processing, storage, and complex analytical queries for business solutions.
Role type
Senior Data Engineer (Data Development)
Builds
Scalable data pipelines, data models, and visualization solutions
Domain
Data Engineering / Big Data
Deliverable
production ML models
Required skills
SQL, Python, Java, Go, Data Modeling, Data Warehouse Architecture, ETL/ELT, Data Quality Assurance
Preferred skills
Apache Hadoop, Spark, Kafka, Flink, Snowflake, Databricks, BigQuery, Data Governance, Machine Learning collaboration
Technologies
Hadoop, Spark, Kafka, Flink, Snowflake, Databricks, BigQuery
Responsibilities
Design and optimize scalable data pipelines for massive data ingestion and transformation; Evaluate and maintain data infrastructure tools for efficient processing and querying; Implement data quality validation and monitoring mechanisms; Design high-reliability data models and visualization schemes; Collaborate with product managers and ML engineers to deliver data solutions.