Системный инженер (Linux-администрирование)
Summary
Linux Engineer responsible for day-to-day Linux server operations, troubleshooting infrastructure issues, automating tasks with Bash and Ansible, and working with monitoring/logging stacks like Prometheus/Grafana and ELK.
Мы в поисках Linux Engineer в команду Linux / infrastructure Engineering. Основной фокус роли: эксплуатация Linux-серверов, диагностика типовых проблем, работа с сервисами, сетью, логами, правами доступа, ресурсами системы и автоматизация повторяющихся операций.
Основные задачи
- Администрировать Linux-серверы: пользователи, права, systemd-сервисы, пакеты, диски, сетевые настройки, журналы, базовая безопасность.
- Разбирать типовые проблемы Linux-систем и инфраструктурных сервисов: недоступность сервисов, ошибки запуска, нехватка ресурсов, проблемы с сетью, DNS, сертификатами, правами доступа.
- Проводить диагностику: состояние процессов, нагрузка на CPU/RAM/disk IO, сетевые соединения, системные лимиты, логи, конфигурации.
- Читать системные и сервисные логи: journalctl, syslog, логи nginx, логи инфраструктурных сервисов и базовые логи контейнерной среды.
- Выполнять регламентные работы: обновления, проверки состояния сервисов, перезапуски, контроль места на дисках, проверка доступности и подготовка отчётов по результатам.
- Автоматизировать повторяющиеся операции с помощью Bash и Ansible: установка пакетов, настройка сервисов, проверка конфигураций, сбор диагностической информации.
- Работать с Git: читать изменения, создавать ветки, оформлять merge request, проходить code review и вносить правки по замечаниям.
- Читать существующий Ansible-код, понимать структуру инфраструктурных репозиториев и вносить изменения по готовым шаблонам.
- Работать с мониторингом и логированием: находить нужные метрики, проверять алерты, сопоставлять графики с логами и состоянием системы.
- Поддерживать внутреннюю документацию: инструкции, runbook, чек-листы диагностики, описания типовых проблем и способов решения.
Что мы ожидаем
- Уверенное знание Linux на уровне ежедневной работы с сервером: shell, процессы, systemd, пользователи и группы, права, пакеты, файловая система, логи, сервисы.
- Понимание устройства операционной системы: загрузка, процессы, сигналы, systemd units, файловые дескрипторы, лимиты, cron/timers, mount points, swap, базовые механизмы безопасности.
- Умение последовательно диагностировать проблему: определить симптом, собрать факты, проверить гипотезы, найти источник проблемы и зафиксировать результат.
- Понимание базовой сети: IP, маршруты, DNS, TCP/UDP, порты, firewall, curl, ss/netstat, dig/nslookup, traceroute/mtr.
- Практический опыт работы в консоли: Bash, grep/sed/awk на базовом уровне, пайпы, переменные окружения, cron, SSH/SCP/rsync.
- Базовое понимание web-инфраструктуры: HTTP/HTTPS, nginx, reverse proxy, TLS-сертификаты, коды ответов, healthcheck.
- Знание Git на рабочем уровне: clone, branch, commit, push, pull, merge/rebase на базовом уровне, merge request.
- Понимание, зачем нужен Ansible, чем отличается ручная настройка от воспроизводимой конфигурации, почему инфраструктурные изменения должны быть проверяемыми.
- Умение написать простой Bash-скрипт или Ansible playbook для повторяемой операции.
- Аккуратность при работе с production-системами: сначала диагностика и оценка риска, потом изменение.
- Способность читать документацию, runbook и существующие конфиги, а не действовать вслепую.
Будет преимуществом:
- Опыт поддержки Ansible playbook/roles.
- Базовый опыт с Docker: images, containers, volumes, logs, compose.
- Опыт работы с Prometheus/Grafana: найти метрику, посмотреть dashboard, проверить алерт.
- Опыт работы с централизованным логированием: ELK/EFK или аналогичные системы.
- Базовые знания PostgreSQL на уровне эксплуатации: проверить доступность, состояние сервиса, место на диске, логи, подключение.
- Первичное понимание Kubernetes как инфраструктурной среды: pods, services, ingress, namespaces, базовые команды kubectl get/logs/describe.
- Базовое понимание Terraform: providers, resources, variables, plan/apply, state.
- Знакомство с CI/CD и GitOps-подходами на уровне понимания, где живёт инфраструктурный код и как изменения попадают в контур.
- Навыки использования ИИ-агентов в работе: подготовка черновиков скриптов, разбор логов, поиск вариантов решения и проверка результата перед применением.
- Аккуратность в документации: способность после решения проблемы оставить понятную инструкцию для следующего инженера.
Основной стек
Linux, Bash, Network, SSH, systemd, Git, Nginx, Ansible, Docker, Prometheus, Grafana, ELK/EFK, PostgreSQL, Nexus, Ceph, Packer.
Область развития внутри команды
Terraform, GitLab CI, Kubernetes, Helm, Rancher, ArgoCD.
Условия
- График: 5/2 с 9:30 до 18:00;
- Гибридный формат работы в офисе в центре Санкт-Петербурга или удаленно из других городов;
- Официальное оформление по трудовому договору.