SRE инженер
Summary
Manages Kubernetes clusters, Helm charts, and cloud infrastructure in Yandex.Cloud, automating deployments with Terraform/Ansible and ensuring reliability via Prometheus/Grafana.
Зона ответственности:
- Администрирование K8s: Управление кластерами Kubernetes, разработка и сопровождение Helm-чартов, настройка Ingress-контроллеров (Traefik/Nginx) и балансировщиков нагрузки (ALB/TLB) для обеспечения отказоустойчивости сервисов.
- Облачная инфраструктура: Работа с инфраструктурными сервисами Яндекс.Облака, автоматизация развертывания окружений через Terraform и Ansible, настройка систем мониторинга и логирования (Prometheus/Grafana).
- CI/CD и автоматизация: Построение и поддержка пайплайнов поставки, внедрение практик DevOps и GitOps для ускорения релизного цикла и повышения предсказуемости деплоев.
- Архитектурные решения: Анализ и декомпозиция бизнес-требований в технические задания, выбор оптимальных инструментов и подходов, оценка трудозатрат и сроков реализации.
- Стабильность и развитие: Обеспечение надежности продуктивных сред, инициация улучшений инфраструктуры, работа в динамичной среде с высокой степенью неопределенности и сменой приоритетов.
Требования
- Базовые навыки программирования (любой ЯП)
- Опыт работы с Kubernetes (K8s): Ingress, Helm, работа с Helm-чартами
- Знание и опыт настройки балансировщиков нагрузки: ALB, TLB
- Опыт работы с инфраструктурными инструментами Яндекс.Облака
-
Знание и опыт работы с прокси-серверами: Traefik, Nginx
Будет преимуществом:
— Опыт работы в образовательных или стартап-проектах
— Знание CI/CD процессов
— Опыт работы с Terraform, Ansible, Prometheus, Grafana
— Понимание принципов DevOps и GitOps.