English summary for screening — check the original posting before applying.
We are seeking an SRE to design, build, and operate the infrastructure for our online gacha service and new ventures, maximizing system reliability and safety. Our SRE team aims to be "AI-native," rejecting traditional manual server maintenance and fully automating operations using IaC and AI.
Must-haves
- Experience in designing, building, and operating infrastructure platforms.
- Experience with SLO/SLI design and operation.
- Experience with IaC (e.g., Terraform) for infrastructure code management.
- Experience designing and optimizing cloud architectures, primarily on AWS.
- Experience improving CI/CD pipeline reliability and speed.
- Experience establishing incident response flows, on-call systems, and post-mortem culture.
Nice-to-haves
- Experience with observability platforms (metrics, logs, traces).
- Experience with capacity planning, cost optimization, and performance tuning.
- Experience establishing security baselines and vulnerability management.
- Experience automating and improving infrastructure operations using AI tools like Claude Code, Cursor, and LLM APIs.
- Experience promoting reliability practices and developing guidelines for development teams.
Tech stack
TerraformAWSClaude CodeCursorLLM API