SPRINT OFFER для SRE- и DevOps-инженеров за 3 дня
DevOps-инженер (специалист/старший/ведущий)
Основные задачи
- Проектирование, разработка и поддержка сетевых и инфраструктурных сервисов на базе Linux и Open Source-решений с использованием IaC, в том числе кластерных систем.
- Поддержка, развитие и актуализация CI/CD-инфраструктуры на базе Jenkins и GitLab.
- Развёртывание, масштабирование и устранение неисправностей Kubernetes-кластеров с использованием ArgoCD.
- Поддержка облачной платформы виртуализации OpenStack.
- Поддержка СУБД и других хранилищ данных: PostgreSQL, MongoDB, OpenSearch.
- Работа с автоматизацией CI/CD.
- Взаимодействие со смежными командами, участие в код-ревью и развитии инженерных практик.
Что мы ожидаем от будущего члена команды:
- Глубокое знание Linux/Unix и практические навыки работы с виртуализацией на базе KVM, включая libvirt и OpenStack.
- Понимание принципов работы сетей, вычислительных систем и систем хранения данных.
- Уверенное владение Bash и одним из языков: Python, Groovy или Go.
- Практика построения и поддержки CI/CD-платформ.
- Навыки работы с PostgreSQL, ClickHouse или другими реляционными и аналитическими БД.
- Уверенная работа с Kubernetes и контейнерными технологиями: Docker, Podman, containerd, CRI-O.
- Знание систем мониторинга: Prometheus, VictoriaMetrics, Zabbix.
- Работа с системами централизованного сбора и анализа системных журналов.
Будет плюсом (опционально):
- Опыт работы с системами передачи сообщений и менеджерами очередей: Kafka, RabbitMQ.
- Владение Go и языками JVM-стека: Java, Scala, Groovy.
- Навыки работы с системами управления конфигурациями: Ansible, Puppet, OpenTofu.
- Опыт работы с системами резервного копирования.
- Понимание принципов построения high-availability систем.
- Опыт работы с многоконтурными средами Dev/Test/Prod.
- Владение другими языками программирования общего назначения.
SRE-инженер (специалист/старший/ведущий)
Основные задачи:
- Приём в эксплуатацию и запуск компонентов и сервисов web-приложения (SPA, JS, Python).
- Обеспечение доступности сервисов в соответствии с SLA, участие в развитии и масштабировании инфраструктуры.
- Настройка, мониторинг и автоматизация CI/CD-процессов.
- Решение инцидентов, эскалированных от L1/L2, подготовка документации и инструкций для команд поддержки.
- Взаимодействие с командами разработки, тестирования и поддержки на всех этапах жизненного цикла сервисов.
Что мы ожидаем от будущего члена команды:
- Опыт поддержки prod-окружений для web-приложений от 3 лет.
- Опыт построения prod-систем с нуля.
- Опыт администрирования Linux от 3 лет.
- Опыт работы с сетями (Ethernet) от 3 лет.
- Фундаментальные знания и опыт траблшутинга сетевого стека TCP/IP (TCP, UDP, NAT/SNAT/DNAT/PAT, HTTP/HTTPS, DNS).
- Понимание основ ИБ (сетевая безопасность, сертификаты, правила работы со служебной информацией).
Будет плюсом (опционально):
- Навыки подготовки документации в Confluence и взаимодействия с L1/L2, включая разработку и актуализацию инструкций.
- Знание принципов SLA/SLO/SLI и умение применять их на практике.
- Практический опыт работы с Docker и Kubernetes.
- Практика работы с ML-окружением и брокером сообщений Kafka.
- Понимание принципов CI/CD и Infrastructure as Code, уверенное владение Ansible.
- Опыт работы со стеком мониторинга и логирования: VictoriaMetrics/Prometheus, Alertmanager, Grafana, OpenSearch — настройка сбора метрик и логов, создание и доработка дашбордов.
Формат работы
Удалённо / гибрид / офис.
Мы уделяем особенное внимание кандидатам с Дальнего Востока и из регионов в часовых поясах GMT+5–GMT+10, но рассматриваем специалистов по всей России. Работа возможна удалённо или из офисов YADRO в городах присутствия: Москве, Санкт-Петербурге, Зеленограде, Нижнем Новгороде, Казани и Екатеринбурге.
