DevOps / Infrastructure Engineer (AI-first)
Summary
Build and scale the Kubernetes-based infrastructure that powers an AI-first platform, optimizing GPU resources and local LLM deployments for enterprise use.
Мы в поиске DevOps / Infrastructure инженера на AI-first продукт для бизнеса, в котором искусственный интеллект является ядром всей архитектуры, а не отдельной функцией.
Работаем с локальными LLM, собственной AI-инфраструктурой, современным стеком Kubernetes и строим платформу, способную масштабироваться от нескольких пользователей до промышленной эксплуатации.
Чем предстоит заниматься:
-
Развивать и масштабировать AI-инфраструктуру для работы локальных LLM
-
Оптимизировать производительность сервисов и использование вычислительных ресурсов
-
Разворачивать и сопровождать инфраструктуру (Docker, Kubernetes, CI/CD)
-
Интегрировать продукт с инфраструктурой заказчиков (локальные серверы и облачные платформы)
-
Участвовать в выборе и тестировании новых технологий, оборудования и AI-решений
-
Обеспечивать надежность системы: диагностировать инциденты, устранять первопричины, улучшать мониторинг и отказоустойчивость
-
Уверенное знание Linux и работа в терминале
-
Опыт работы с Docker, Docker Compose
-
Опыт работы с Kubernetes и Helm
-
Опыт настройки и поддержки CI/CD
-
Работа с GPU и локальными LLM (Ollama, vLLM)
-
Хорошее знание Git
-
Навыки диагностики и анализа логов
-
Опыт автоматизации и тестирования (pytest будет преимуществом)
-
Базовые знания SQL
-
Умение использовать AI-инструменты (ChatGPT, Claude, Copilot и др.) в ежедневной работе и проверять их результаты перед применением
- Опыт с Argo CD, GitOps, Harbor
- Опыт эксплуатации Kubernetes в production
- Опыт работы с RAG, высоконагруженными системами и AI-инфраструктурой.