Senior DevOps инженер
Summary
Senior DevOps engineer designing and running Linux/Kubernetes infrastructure for a large distributed product company (ad platforms, games, mobile entertainment and fintech apps). Day to day: IaC with Ansible/Terraform, CI/CD automation, observability (metrics, logs, alerting), HA/fault-tolerant architecture, troubleshooting across Linux, K8s, network and apps, plus production on-call.
Наша распределенная команда Dev насчитывает более 800 специалистов и разрабатывает собственные продукты с 2012 года – рекламные платформы, игры, мобильные развлекательные приложения и финтех-продукты.
У нас проектно-ориентированный подход, матричная структура с привязкой специалистов к одному проекту, но при этом мы работаем командой. В работе мы применяем SCRUM, Agile.
Обязанности:-
Разработка и поддержка инфраструктуры на базе Linux и Kubernetes;
-
Создание и управление инфраструктурой как кодом (IaC) с использованием Ansible и Terraform;
-
Обеспечение высокой доступности и производительности систем и решение возникающих проблем;
-
Развитие observability: метрики, логи, алертинг, дашборды;
-
Автоматизация процессов развертывания и интеграции (CI/CD);
-
Сотрудничество с командами разработки и эксплуатации для улучшения процессов;
-
Проектирование и развитие отказоустойчивой инфраструктуры;
-
Диагностика и устранение проблем на уровне Linux, Kubernetes, сети и приложений;
-
Участие в архитектурных решениях и техническом развитии инфраструктуры;
-
Автоматизация рутинных операций и снижение количества ручных действий;
-
Работа с production-инцидентами, принимать участие при on-call.
-
Глубокие знания операционных систем на базе ядра Linux;
-
Опыт работы с Kubernetes, Helm;
-
Понимание сетей: TCP/IP, DNS, HTTP/HTTPS, балансировка нагрузки;
-
Опыт сопровождения Kafka;
-
Опыт работы с базами данных PostgreSQL, MongoDB;
-
Опыт работы с Git, Git Flow и построением инфраструктурных CI/CD pipelines;
-
Опыт построения observability: VictoriaMetrics/Prometheus, Grafana, Loki, ELK/EFK, Alertmanager;
-
Уверенное владение инструментами IaC: Ansible и Terraform;
-
Знание английского языка, достаточное для работы с технической документацией и поиска решений проблем;
-
Отличные навыки коммуникации и умение работать в команде;
-
Способность принимать технические решения и нести ответственность за их реализацию;
-
Практический опыт troubleshooting Linux и Kubernetes;
-
Понимание принципов HA, fault tolerance и disaster recovery.
Будет плюсом:
-
Опыт работы в сфере Big Data и Machine Learning;
-
Опыт с k8s (Talos/RKE2) на bare-metal + GPU;
-
Опыт работы с Slurm;
-
Опыт работы с OpenNebula, Proxmox;
-
Опыт построения CI/CD с SAST/DAST, container/dependency/secret scanning;
-
Cilium и понимание Kubernetes networking;
-
Знание Python и/или Go.
-
Несколько вариантов оформления и способов выплат;
-
Full remote или гибридный офис, работа из любой страны с удобным часовым поясом;
-
Гибкий график - лояльное начало дня с 9.00 до 11.00 по МСК, 8 часов рабочий день;
- Возможность выбрать привычное оборудование с доставкой на дом;
-
Performance review и непрерывное обучение: у нас есть внутренняя Академия, а также много партнёрских программ, которые поделятся знаниям не только в профессиональной сфере, но и поддержат твои хобби;
-
Развитая культура коммуникаций: турниры онлайн и оффлайн, тех комьюнити, митапы, co-working дни, встречи и пати на летней веранде, тимбилдинги;
-
Офис с панорамой на Москву-реку и летняя веранда с гамаками и пиццей для тех, кто работает в Москве и локальные тимбилдинги в других городах и странах для удаленщиков.
-
Офис с панорамой на Москву-реку и летняя веранда с шашлыками, гамаками и пицце для тех, кто работает в Москве и локальные тимбилдинги в других городах и странах для удаленщиков.