Posted Updated
Наша команда создает линейку продуктов на основе мультимодальной нейросетевой модели GigaChat, которая является одной из самых мощных и продвинутых моделей искусственного интеллекта, доступных на сегодняшний день.
Мы создаем удобный и понятный сервис, позволяющий людям использовать GigaChat для решения повседневных задач и развлечения: поиск ответов на вопросы, работа с документами, создание контента, изучение языков, общение с персонажами и многое другое.
Мы ищем опытного Senior-инженера SRE, который возглавит развитие front-инфраструктуры. Вы будете отвечать не только за техническую реализацию, но и за менторство команды, архитектурные решения и стратегическое развитие надежности сервиса.
Ваша ключевая задача — построение и развитие системы Observability для высоконагруженной micro-frontend архитектуры, обеспечение ее отказоустойчивости, масштабируемости и безопасности. Вы будете напрямую влиять на SLA/SLI/SLO сервиса и качество продукта, которым пользуются миллионы.* проектирование, внедрение и поддержка отказоустойчивой front-инфраструктуры **giga.chat**.
* построение сквозной системы мониторинга, логирования и трейсинга (Observability) для micro-frontend систем.
* организация процесса управления инцидентами (Incident Management), поиски (Root Cause), внедрение превентивных мер.
* развитие инфраструктуры как кода (Infrastructure as Code), автоматизация процессов развертывания, масштабирования и управления конфигурациями.
* наставничество Middle-инженеров, code-review инфраструктурного кода, развитие инженерных практик в команде.* **Уровень:** Senior (от 5 лет опыта в SRE/DevOps), наличие подтвержденного опыта на позиции Team Lead или готовность к руководящей роли.
* **Архитектура и сети:**
* Глубокое понимание принципов построения высоконагруженных и отказоустойчивых систем.
* Экспертное знание сетевого стека (модель OSI, TCP/IP, BGP, DNS). Опыт диагностики сложных сетевых проблем в production-среде.
* Экспертный уровень владения балансировщиками: NGiNX (включая Lua/NJS для сложной логики), HAProxy, Traefik. Опыт их тюнинга под экстремальные нагрузки.
* **Observability:**
* Успешный опыт построения комплексных систем Observability "с нуля" для микросервисных и micro-frontend архитектур.
* Экспертиза в стеке Prometheus + Grafana: написание сложных PromQL-запросов, проектирование дашбордов и алертов.
* Глубокое знание систем логирования (ELK Stack) и распределенной трассировки (Jaeger, Zipkin). Умение коррелировать метрики, логи и трейсы для быстрого поиска аномалий.
* **Безопасность:**
* Глубокие знания в области информационной безопасности. Опыт внедрения Zero Trust архитектуры, настройки WAF, защиты от DDoS-атак на уровне L7, управления секретами (Vault).
* **Инфраструктура:**
* Экспертный уровень администрирования Linux.
* Экспертиза в Kubernetes: управление кластерами в production, написание Helm-чартов, диагностика проблем на уровне Control Plane и Data Plane.
* Уверенное владение IaC-инструментами (Terraform, Ansible) на уровне написания модулей и ролей.
Будет плюсом:
* Опыт работы с облачными провайдерами (Sber Cloud, Yandex Cloud, AWS) на уровне построения гибридных инфраструктур.
* Опыт работы с Service Mesh (Istio)
* Опыт работы с базами данных (PostgreSQL, Elasticsearch, ClickHouse, Mongo)
* Опыт работы с системами очередей и кеш-серверами (Kafka, Ignite, Redis)* стабильный оклад и премии по результатам работы, ежегодный пересмотр зарплаты
* комфортный современный офис рядом с м.Кутузовская
* гибридный формат работы: встречаемся очно в офисе 1 раз в неделю
* корпоративный спортзал и зоны отдыха
* уникальная система обучения Сбера для профессионального и карьерного развития
* программа адаптации и помощь руководителя на старте
* расширенный ДМС и льготное страхование семьи
* гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
* бесплатная подписка СберПрайм, скидки на продукты компаний-партнеров
* вознаграждение за рекомендацию друзей в команду Сбера
* корпоративная пенсионная программа