We are looking for a Site Reliability Engineer (SRE) to join our engineering team, responsible for improving system reliability, scalability, and operational efficiency across our platform.
This role focuses on engineering solutions to prevent incidents and improve long-term system reliability, rather than only reacting to operational issues. You will work closely with L2 Support, DevSecOps, and development teams to analyze production issues, eliminate recurring problems, and enhance system resilience in a distributed, cloud-based environment.
You will play a key role in transforming operational insights into long-term improvements, automation, and reliability engineering practices.