Senior/Staff Engineer, Operations Automation & Cloud Management Platform
Core
Design and develop a unified Operations Automation & Cloud Management Platform for intelligent orchestration of multi-cloud resources.
Role type
Senior/Staff Platform Engineer (Cloud Operations & AI)
Builds
Full-lifecycle management capabilities for compute, storage, network, database, and middleware across Aliyun, AWS, and Azure.
Domain
Cloud Infrastructure & AI/LLM
Deliverable
production ML models | infrastructure
Required skills
Java, Spring/Spring Boot/Spring Cloud, Multi-cloud API integration (Aliyun, AWS, Azure), Terraform, Distributed systems architecture, CMDB design, Orchestration engine development, Event center design, AI/LLM application development (Prompt Engineering, RAG, Agent), RESTful/gRPC interface design, Platform security (OIDC, IAM, RBAC)
Preferred skills
Experience building intelligent ops assistants (ChatOps/AI Copilot), Capacity/cost prediction modeling
Technologies
Java, Spring, Spring Boot, Spring Cloud, Aliyun, AWS, Azure, Terraform, gRPC, OIDC, IAM, RBAC
Responsibilities
Design and develop core systems including CMDB, Event Center, and orchestration engines; Integrate cloud provider APIs to enable automated provisioning and cost optimization; Build intelligent cloud management capabilities leveraging AI/LLM for change-risk assessment; Design and maintain unified RESTful/gRPC interfaces and SDKs; Participate in platform security and operations.
Seniority
Senior/Staff, hands-on IC