Инженер сопровождения
Posted
Мы ищем специалиста, который обеспечит бесперебойную работу критически важных систем банка. Ваша главная задача — гарантировать доступность сервисов в промышленных и тестовых контурах, быстро диагностировать сбои, управлять инцидентами второй линии (L2) и закрывать IT-риски.
О проектах:
* GMBW — платформа блокчейн-продуктов Департамента глобальных рынков (ДГР) Сбера.
* Платформа ЦФА — системы, обслуживающие бизнес Сбера по цифровым финансовым активам: выпуск, учёт и обращение ЦФА на блокчейн-инфраструктуре.* обеспечивать непрерывную доступность систем обоих проектов (GMBW и ЦФА) в четырех контурах: DEV, ИФТ, ПСИ, ПРОМ, выполнять роль второй линии поддержки (L2): принимать алерты мониторинга (Dynatrace, логи Тенгри), проводить первичную диагностику причин деградации производительности или отказов
* если инцидент вызван ошибкой в коде приложения или требует изменения архитектуры — корректно оформлять задачу с собранными диагностическими данными (логи, трейсы OpenTelemetry, дампы) и передавать её команде разработки, закрывать выявленные уязвимости на уровне ОС (RHEL 8/9) — планировать и устанавливать обновления безопасности (_security updates_, патчи ядра CVE)
* устранять уязвимости в прикладном ПО: контролировать обновление версий Java Runtime, библиотек Spring Boot, компонентов Docker-образов до безопасных версий согласно матрице совместимости.
* администрировать кластеры OpenShift/Kubernetes: отслеживать состояние подов, событий (_Events_), квот ресурсов; выполнять перезапуски зависших микросервисов платформы ЦФА и GMBW, диагностировать работу брокеров сообщений Apache Kafka: проверять отставание потребителей (_Consumer lag_), наличие ошибок репликации через _Kafka Connect_
* работать с базами данных PostgreSQL: выполнение базовых запросов для проверки целостности данных, анализ долгих транзакций совместно с DBA
* анализировать сетевые взаимодействия между сервисами (nginx-прокси,
* участвовать в приемо-сдаточных испытаниях (ПСИ): проверять работоспособность функционала на тестовых стендах перед выводом в ПРОМ.* высшее техническое образования
* опыт администрирования Linux (RHEL/CentOS) от 2 лет: понимание systemd, файловых систем, базовой настройки сети (ip route, ss, tcpdump), глубокие знания SQL и опыт работы с реляционными СУБД (PostgreSQL) на уровне написания запросов для анализа данных.
* практический опыт администрирования приложений в облаке или on-premise средах (OpenShift, Kubernetes.
* Навыки работы с системами мониторинга: умение строить запросы в Dynatrace/Prometheus, настраивать дашборды и триггеры алертинга.
* понимание принципов ITIL / ITSM: знание разницы между инцидентом, проблемой и запросом на обслуживание, владение инструментами класса Service Desk.
* навыки чтения кода приложений (Java/Spring Boot stacktraces, Python traceback) для локализации источника ошибки без необходимости его исправления самим инженером.
* английский язык на уровне чтения технической документации.
**Дополнительные преимущества (не обязательные):**
* знания в области блокчейн-технологий (понимание того, как работают ноды Ethereum или Bitcoin, что такое синхронизация цепочки).* комфортный современный офис г. Москва, Кутузовский проспект 32
* гибридный формат работы
* ежегодный пересмотр зарплаты, годовая премия
* корпоративный спортзал и зоны отдыха
* система обучения для профессионального и карьерного развития
* расширенный полис ДМС с первого дня работы и страхование для семьи
* программа ипотеки для сотрудников
* подписка Прайм с возможностью совместного использования на трёх близких
* вознаграждение за рекомендацию друзей в команду Сбера.