SRE инженер (система мониторинга)

Open 18d
Мы создаем новую команду развития мониторинга для систем рисков корпоративно-инвестиционного бизнеса. Наша задача — с нуля выстроить единый, масштабируемый и управляемый контур мониторинга для более чем 110 ИТ-услуг, от которых зависит контроль кредитного риска и устойчивость критичных бизнес-процессов. Ищем SRE-инженера, который будет развивать систему мониторинга и алертинга: проектировать подходы, внедрять новые решения, повышать наблюдаемость сервисов и участвовать в создании единого мониторинга для большого и критичного ИТ-ландшафта.**Требования по стеку:** * опыт работы с Unix-based системами (RH, Centos), команды, службы, типовые задачи * контейнеризация: OS, Kubernetes, на уровне пользователя * Prometheus exporters – уверенные знания (понимание принципа генерации и работы, установка, настройка, администрирование и поддержка экспортеров для разных источников данных) * Prometheus + Alertmanager – уверенные знания (федерация, тюнинг, решение типовых проблем) * Grafana – уверенные знания (v10+ панели, источники данных, разграничение доступов, provisioning, unified alerting) * Opensearch + Dashboards (ELK) — уверенные знания. Кластеризация, настройка индексов (mapping), шардирование и репликация, оптимизация производительности, разграничение ролей, прокси-авторизация * Logstash, Data Prepper, Vector - уверенные знания, разные источники, фильтры, преобразование * Kafka - Schema, настройка тракта kafka - data prepper - opensearch и его тюнинг* IaC (Ansible, Helm) - решение типовых задач, написание плейбуков и чартов * PromQL, KQL, DQL - создание дашбордов и алертов в системах визуализации * Сертификаты - понимание принципа работы, расширений, типов хранилищ * написание pipeline обработки данных в одном из инструментов: Logstash, Datapreper, Datatog Vector, OpenTelemetry Collector. * опыт работы с системами сбора логов и метрик (Fluentd, Fluent-bit) **Желательные (будут плюсом):** * работа с инструментами CI, CDl, CDp (Jenkins) - опыт работы как пользователя. Умение работать с groovy будет плюсом. * Навыки автоматизации рутинных задач (скрипты на Bash/Python). * Victoria metrics (установка, настройка и сопровождение кластерной версии. Опты работы с vmagent / vmalert) * Prompt engineering, умение работать с агентами и LLM через MD будет плюсом. * опыт создания AI-агентов и использования их в работе будет преимуществом.* формат работы гибирдный * стабильный оклад + годовое премирование и социальная поддержка сотрудников * официальное оформление с первого дня * профессиональный и дружный коллектив, готовый принимать и считаться с любой точкой зрения * расширенный ДМС с первого дня работы для сотрудников и льготная медицинская страховка для близких * бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров * корпоративная пенсионная программа * корпоративное обучение за счет компании, в т.ч. посещать конференции по профессиональной тематике, а так же огромный каталог образовательных программ * реферальная программа для сотрудников: можно пригласить в команду знакомых профессионалов и получить вознаграждение до 100 тыс. рублей * корпоративный спортзал и скидки в спортзалы-партнеры * мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы· * работу по Agile с лучшими из IT индустрии: 2000 продуктовых команд и возможность внутреннего перемещения * яркая и насыщенная корпоративная жизнь: «Зелёный марафон», Сбербанкиада, КВН, волонтёрские программы и т.д. * свободный dress code * возможность самостоятельного выбора необходимых технологий, а так же возможность привнести своё видение в проект