Site Reliability Engineer
XsollaRussiaFull TimeEngineering
Remotely
datadogkubernetesterraformgithub actionsprometheusopentelemetrygitlab cihelm
Job Description
📋 Description
- Ответственность за инфраструктуру на уровне приложений: Helm-чарты, Terraform
- Observability в рамках продуктового домена: проектирование и внедрение SLO/SLI, мониторы, алерты и
- Развитие CI/CD пайплайнов для сервиса: GitLab CI, GitHub Actions, автоматизация деплоя и отката.
- Планирование производительности и емкости инфраструктуры, performance tuning перед пиковыми
- Production Readiness Review для новых сервисов и изменений; контроль готовности к эксплуатации в
- Участие в инцидент-реакции и глубоком расследовании, подготовке постмортемов и улучшений
🎯 Requirements
- От 3 лет опыта SRE/DevOps/Platform Engineer: on-call, SLO/monitoring, deployment pipelines
- Опыт разработки ПО: чтение/анализ кода и production-grade автоматизация на языках Python/Go/Bash.
- Опыт Kubernetes: Helm, манифесты, стратегии деплоя, диагностика производительности и сетевых
- Глубокие знания observability: мониторы, дашборды, SLO/SLI; Datadog; OpenTelemetry
- Опыт работы с Infrastructure as Code: Terraform/Terragrunt.
- Опыт работы с GCP (IAM, networking, managed services).
🎁 Benefits
- Развитие и обучение: доступ к внутренней платформе, конференции, хакатоны, митапы и воркшопы.
- Современные инструменты: Mac, доступ к ИИ-сервисам для повышения продуктивности.
- Здоровье: ДМС со стоматологией для вас и семьи, 21 день больничного.
- Глобальные возможности: международные проекты, командировки и релокация в зарубежные офисы.
- Удалёнка с комфортом: компенсация обустройства рабочего места дома.
Back to all jobs