Remotevia Telegramposted 7/9/2026
Инженер мониторинга (ночные смены)
Employer Location УдаленноComp Обсуждается на собеседованииSchedule 2/2 по 12 часов, вечерние и ночные смены
Компания ищет инженера мониторинга, который будет заниматься анализом инцидентов, диагностикой проблем в высоконагруженной микросервисной инфраструктуре и оперативным взаимодействием с командами разработки и партнёрами.
Что делать
- Обрабатывать и классифицировать обращения внутренних пользователей.
- Оперативно реагировать на инциденты, диагностировать и устранять типовые проблемы.
- Анализировать события в микросервисной архитектуре и восстанавливать цепочки инцидентов.
- Формулировать и проверять гипотезы о причинах сбоев.
- Готовить информацию и эскалировать сложные инциденты на третью линию поддержки.
- Взаимодействовать с техническими командами партнёров при внешних сбоях.
- Постоянно мониторить состояние сервисов через системы логирования и мониторинга.
- Выявлять аномалии до срабатывания алертов (рост latency, memory leak, retry, error rate и др.).
Что нужно
- Опыт работы инженером технической поддержки или мониторинга от 2 лет.
- Понимание принципов работы высоконагруженных систем.
- Умение анализировать логи, метрики и трассировки (logs, metrics, traces).
- Опыт работы с REST API, Postman, Swagger или аналогичными инструментами.
- Навыки анализа логов в Grafana (Loki), Kibana или аналогичных системах.
- Опыт работы с Jira.
- Умение выявлять причины инцидентов и восстанавливать последовательность событий.
Будет плюсом
- Опыт настройки и сопровождения систем мониторинга.
- Понимание HTTP, TCP, SSL Handshake и сетевых ошибок.
- Опыт работы с RabbitMQ, retry-механизмами и принципами idempotency.
- Знание Kubernetes, Helm, контейнеризации и Linkerd.
Что предлагают
- Полностью удаленная работа.
- График 2/2 с 12-часовыми вечерними и ночными сменами.
- Оформление по ГПХ (самозанятый, ИП или физлицо).
- Работа с высоконагруженными микросервисными системами.
- Возможность профессионального развития в сильной технической команде.
Стек и операторы
incident managementmonitoringhigh-load systemsmicroservicesrest apipostmanswaggergrafanalokikibanajiralogs analysismetricstraceskuberneteshelmrabbitmqlinkerdhttptcpsslidempotencyretry mechanisms