Point your AI agent at freehire and let it find you a job.

Get the CLI →

YADRO

New

SRE-инженер

Posted Updated 2 views
Discussion

Summary

SRE engineer at YADRO running and scaling the infrastructure of a web application (SPA, JS, Python): ensuring availability per SLA, improving CI/CD and monitoring, documenting for L1/L2 and resolving escalated incidents, with on-call rotations of alternating 8-hour day/night shifts. Core stack: Linux, TCP/IP networking, Docker/Kubernetes, Ansible, Prometheus/Victoria Metrics, Grafana.

Чем предстоит заниматься:

  • Приём в эксплуатацию и запуск компонентов и сервисов Web приложения (SPA, JS, Python).
  • Обеспечение доступности компонентов и сервисов в соответствии с принятыми SLA.
  • Участие в развитии и масштабировании инфраструктуры Web приложения.
  • Активное взаимодействие с командами разработки, тестирования и поддержки Web приложения.
  • Настройка, мониторинг, автоматизация, улучшение CI/CD процессов Web приложения.
  • Участие в жизненном цикле компонентов и сервисов Web приложения.
  • Проверка и подготовка документации и инструкций для L1/L2.
  • Решение возникающих инцидентов, эскалированных от L1/L2.

Мы ждем от будущего члена команды:

  • Опыт поддержки prod-окружений для Web-приложений от 3-х лет.
  • Опыт построения prod-систем "с нуля".
  • Опыт администрирования Linux от 3-х лет.
  • Опыт работы с сетями (Ethernet) от 3-х лет.
  • Фундаментальные знания и опыт траблшутинга сетевого стека TCP/IP (TCP, UDP, NAT/SNAT/DNAT/PAT, HTTP/HTTPS, DNS).
  • Понимание основ ИБ (сетевая безопасность, сертификаты, правила работы со служебной информацией).
  • Готовность работать в режиме дежурств по графику: чередование дневных и ночных смен по 8 часов.

Дополнительно приветствуем:

  • Опыт подготовки документации (Confluence).
  • Понимание, что такое SLA/SLO/SLI, и как с ними работать.
  • Опыт взаимодействия с 1/2 линией ТП, в том числе разработка/модификация инструкций для L1/L2.
  • Опыт работы с контейнерными средами и платформами их оркестрации (Docker/Kubernetes).
  • Опыт работы с ML-окружением.
  • Опыт работы с брокерами сообщений (Kafka).
  • Понимание принципов CI/CD и подхода к описанию инфраструктуры Infrastructure as Code.
  • Уверенная работа с системой управления конфигурациями Ansible.
  • Опыт работы с платформой мониторинга и логирования на базе Victoria Metrics/Prometheus, Alert Manager, Grafana, OpenSearch, в том числе настройка сборщиков метрик, получения логов от приложения и настройка на их основе дашбордов, создание/модификация дашбордов в Grafana.

Skills

See also

SRE jobs by country — openings, pay and top skills →

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available