DevOps / SRE-инженер (Kubernetes, Highload)
Зарплата: 100000–150000 RUR (на руки)
Мы развиваем ряд IT-платформ для автоматизации операционных процессов. Наши продукты применяются в производственной индустрии, HoReCa и бухгалтерии. Системы работают с высокой нагрузкой, большой базой физических пользователей и ежедневно обрабатывают значительный объём операций, поэтому для нас критичны стабильность, наблюдаемость и производительность инфраструктуры. Также мы развиваем проекты в области распознавания и обработки документов с фокусом на применение ML / AI. У инженера будет возможность работать как с высоконагруженными продуктами, так и с новыми проектами на стадии активного развития.Ищем DevOps / SRE-инженера, который возьмёт на себя поддержку, развитие и повышение надёжности инфраструктуры. У нас небольшая команда без лишней бюрократии: можно влиять на архитектурные решения, инструменты и процессы эксплуатации.
Задачи
- Поддерживать и развивать Kubernetes-кластер на bare-metal инфраструктуре.
- Обеспечивать стабильную работу высоконагруженных сервисов: мониторинг, отказоустойчивость, производительность и масштабирование.
- Развивать observability-стек: Grafana, OpenTelemetry, Victoria metrics, централизованное логирование, метрики и алертинг.
- Администрировать и поддерживать Keycloak: аутентификация, авторизация, управление доступами.
- Настраивать и развивать CI/CD, автоматизировать развёртывание и обновления.
- Анализировать инциденты, искать узкие места и предотвращать повторение сбоев.
- Работать с безопасностью инфраструктуры, секретами, доступами, резервным копированием и восстановлением.
- Документировать инфраструктуру и ключевые эксплуатационные процессы.
- Вместе с разработчиками улучшать релизный процесс и надёжность сервисов.
Инфраструктура
- Kubernetes-кластер на bare-metal инфраструктуре.
- Высокая нагрузка и требования к стабильности.
- Grafana, OpenTelemetry, Victoria metrics, Keycloak.
- Полностью удалённый формат.
- Официальное оформление в IT-компании.
Что ожидаем
- Коммерческий опыт DevOps / SRE-инженером от 2–3 лет.
- Уверенное знание Linux.
- Практический опыт эксплуатации Kubernetes в production.
- Опыт работы с Docker и контейнерной инфраструктурой.
- Понимание мониторинга, метрик, логирования и алертинга: Grafana, Prometheus-совместимые решения, OpenTelemetry, Vector или аналоги.
- Опыт работы с Keycloak либо понимание OAuth 2.0, OpenID Connect, SSO и управления доступом.
- Навыки автоматизации: Bash, Python или Go.
- Опыт с CI/CD.
- Понимание сетей, TLS, DNS, reverse proxy и firewall.
- Умение самостоятельно диагностировать проблемы и доводить задачи до результата.
Будет плюсом
- Terraform, Ansible, Helm, Argo CD или Flux CD.
- Опыт с PostgreSQL, Redis, Kafka, RabbitMQ и другими инфраструктурными компонентами.
- Опыт построения отказоустойчивых систем, резервного копирования и disaster recovery.
- Опыт оптимизации производительности Kubernetes и Linux.
- Практика эксплуатации self-hosted / bare-metal инфраструктуры.
Условия
- Полностью удалённая работа.
- Зарплата: 100 000–150 000 ₽ в месяц, зависит от опыта кандидата.
- Официальное оформление.
- Минимум бюрократии и возможность влиять на архитектуру, а не только поддерживать существующую систему.