大数据计算引擎架构师-Data
Core
Design and build a big data computing engine service to support ByteDance product lines (e.g., Douyin, Toutiao) by providing powerful, easy-to-use OLAP computing services.
Role type
Senior IC big data computing engine architect
Builds
Offline data warehouse computing engine architecture and OLAP computing services
Domain
Big Data / Distributed Systems / OLAP
Required skills
Spark, Presto, Flink, Hive, SQL optimizer development, offline data warehouse architecture, multi-datacenter architecture, Java, Scala, JVM internals, concurrency, IO resource management, network programming, large-scale system debugging and performance optimization
Preferred skills
SQL optimization, data warehouse refactoring, data governance
Technologies
Spark SQL, Presto, Hudi, Flink, Druid, Kylin, Hive
Responsibilities
Design and implement offline data warehouse computing engine architecture for multi-datacenter environments; Integrate and optimize SQL semantics and SQL optimizers for Spark SQL, Presto, and Flink; Participate in requirement analysis, technical research, and solution design to drive technical projects to business implementation
Seniority
Senior, hands-on IC
