Tasks:
- * Analyze and modify open-source component source code
- * Customize real-time and batch processing capabilities
- * Design and optimize cloud big data architectures
- * Develop and optimize big data infrastructure components
- * Document best practices and develop platform capabilities
- * Improve platform stability and troubleshoot failures
- * Optimize stream processing performance and scheduling
- * Research and implement lakehouse and disaggregated storage solutions
Perks/Benefits:
Skills/Tech stack required:
[AWS] [C++] [CDC] [Checkpointing] [Cloud infrastructure] [Data Warehousing] [Distributed Systems] [Fault Tolerance] [Flink] [Go] [Google Cloud] [Hadoop] [Java] [Kafka] [Microsoft Azure] [Real Time] [Real-time Data] [Real-time data warehousing] [Resource Management] [Scala] [Shuffle] [Spark] [Spark Streaming] [Starrocks] [State management] [Storage Consistency] [Task Scheduling]
Educational requirements:
[Bachelor's Degree]
Role(s):
[Big Data Infrastructure Engineer] [Big Data Open-Source Component Engineer] [Component Engineer] [Data Infrastructure Engineer] [Engineer] [Infrastructure Engineer] [Processing Engineer] [Stream Processing Engineer]