SRE инженер (система мониторинга)
Мы создаем новую команду развития мониторинга для систем рисков корпоративно-инвестиционного бизнеса. Наша задача — с нуля выстроить единый, масштабируемый и управляемый контур мониторинга для более чем 110 ИТ-услуг, от которых зависит контроль кредитного риска и устойчивость критичных бизнес-процессов.
Ищем SRE-инженера, который будет развивать систему мониторинга и алертинга: проектировать подходы, внедрять новые решения, повышать наблюдаемость сервисов и участвовать в создании единого мониторинга для большого и критичного ИТ-ландшафта.**Требования по стеку:**
* опыт работы с Unix-based системами (RH, Centos), команды, службы, типовые задачи
* контейнеризация: OS, Kubernetes, на уровне пользователя
* Prometheus exporters – уверенные знания (понимание принципа генерации и работы, установка, настройка, администрирование и поддержка экспортеров для разных источников данных)
* Prometheus + Alertmanager – уверенные знания (федерация, тюнинг, решение типовых проблем)
* Grafana – уверенные знания (v10+ панели, источники данных, разграничение доступов, provisioning, unified alerting)
* Opensearch + Dashboards (ELK) — уверенные знания. Кластеризация, настройка индексов (mapping), шардирование и репликация, оптимизация производительности, разграничение ролей, прокси-авторизация
* Logstash, Data Prepper, Vector - уверенные знания, разные источники, фильтры, преобразование
* Kafka - Schema, настройка тракта kafka - data prepper - opensearch и его тюнинг* IaC (Ansible, Helm) - решение типовых задач, написание плейбуков и чартов
* PromQL, KQL, DQL - создание дашбордов и алертов в системах визуализации
* Сертификаты - понимание принципа работы, расширений, типов хранилищ
* написание pipeline обработки данных в одном из инструментов: Logstash, Datapreper, Datatog Vector, OpenTelemetry Collector.
* опыт работы с системами сбора логов и метрик (Fluentd, Fluent-bit)
**Желательные (будут плюсом):**
* работа с инструментами CI, CDl, CDp (Jenkins) - опыт работы как пользователя. Умение работать с groovy будет плюсом.
* Навыки автоматизации рутинных задач (скрипты на Bash/Python).
* Victoria metrics (установка, настройка и сопровождение кластерной версии. Опты работы с vmagent / vmalert)
* Prompt engineering, умение работать с агентами и LLM через MD будет плюсом.
* опыт создания AI-агентов и использования их в работе будет преимуществом.* формат работы гибирдный
* стабильный оклад + годовое премирование и социальная поддержка сотрудников
* официальное оформление с первого дня
* профессиональный и дружный коллектив, готовый принимать и считаться с любой точкой зрения
* расширенный ДМС с первого дня работы для сотрудников и льготная медицинская страховка для близких
* бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров
* корпоративная пенсионная программа
* корпоративное обучение за счет компании, в т.ч. посещать конференции по профессиональной тематике, а так же огромный каталог образовательных программ
* реферальная программа для сотрудников: можно пригласить в команду знакомых профессионалов и получить вознаграждение до 100 тыс. рублей
* корпоративный спортзал и скидки в спортзалы-партнеры
* мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы·
* работу по Agile с лучшими из IT индустрии: 2000 продуктовых команд и возможность внутреннего перемещения
* яркая и насыщенная корпоративная жизнь: «Зелёный марафон», Сбербанкиада, КВН, волонтёрские программы и т.д.
* свободный dress code
* возможность самостоятельного выбора необходимых технологий, а так же возможность привнести своё видение в проект