freehire launches on Product Hunt on 26 August.

Follow →

Senior Site Reliability Engineer

Open 28d

Summary

Build and maintain the reliability engineering foundation for a growing product company, designing observability, SLOs, and incident response processes for distributed systems on AWS and Kubernetes.

Galaktica — українська продуктова IT-компанія, що з 2019 року створює мобільні застосунки та вебпродукти для ринків Tier-1. У команді 350+ фахівців з провідною експертизою, які працюють з різних куточків світу. Ми розвиваємо міжнародні продукти, експериментуємо з підходами і швидко масштабуємо рішення, які покращують життя мільйонів користувачів.

Важливою складовою бізнесу Galaktica є благодійність. З 2022 року ми спрямували велику кількість волонтерської допомоги в різні напрямки. У першу чергу, підтримка ЗСУ: десятки позашляховиків і комерційних квадрокоптерів, сотні FPV-дронів, НРК з турелями, квадроцикли. Також розвиваємо два благодійні фонди: фокус на реабілітації військових і на підтримці дітей військовослужбовців та постраждалих від війни.

Про роль:
Ми шукаємо першого Site Reliability Engineer, який закладе фундамент культури надійності в компанії. У міру зростання продуктів і команд зростають і вимоги до стабільності систем, тому нам потрібна людина, яка буде проводити глибокий аналіз інцидентів, знаходити системні причини проблем і допомагати будувати процеси та практики, що підвищують надійність наших сервісів.

На даній посаді вам необхідно буде вирішити наступні задачі:
  • Визначити і підтримувати SLI/SLO для критичних продуктових сервісів;

  • Побудувати regular reliability reporting;

  • Створити і розвивати observability-стратегію в компанії;

  • Вибудувати здатність команд володіти надійністтю своїх сервісів і продуктів;

  • Виступати incident commander для критичних cross-service інцидентів;

  • Впровадити глибокий розбір складних причинно-наслідкових зв'язків між сервісами і командами при вирішенні проблем;

  • Створювати runbooks для типових інцидентів.

Які навички та критерії нам зараз важливі:

  • 5+ років досвіду роботи з production distributed systems, з них 2+ роки у явній SRE-ролі або еквівалентній позиції з SRE-обов'язками;

  • Практичний досвід впровадження SLO/SLI;

  • Глибока експертиза в observability на рівні проектування;

  • Практичний досвід підтримки процесів Incident management в ролі incident commander, ведення blameless postmortems як фасилітатора;

  • Досвід дебагу розподілених production систем в середовищі AWS/Kubernetes;

  • Здатність читати й аналізувати production-код сервісів для пошуку кореневих причин інцидентів;

  • Експертиза в реляційних БД під навантаженням;

  • Вміння аналізувати production-код (Node JS/PHP) для пошуку кореневих причин інцидентів.

Буде плюсом:

  • Досвід першого SRE в компанії або побудови SRE-практик з ранньої стадії;

  • Досвід складних production-міграцій з збереженням доступності.

Що ви у нас знайдете:

  • Стабільність, на яку можна спертися
    Щодня ми будуємо продуктовий бізнес із довгостроковим баченням та стабільним зростанням. У нас вам не доведеться обирати між надійністю та розвитком — можна одночасно працювати над складними задачами та бути впевненим у завтрашньому дні.
  • Гнучкість і комфорт
    Обирате формат роботи, який підходить саме вам: remote, hybrid або офіс у Києві, Львові, Одесі чи Ларнаці. Ми надаємо все необхідне для роботи: ноутбук, монітори, інші гаджети та компенсацію на облаштування домашнього робочого простору. Усі офіси обладнані генераторами та Starlink і доступні для команди 24/7. Робочий графік — з 10:00 до 18:30.
  • Турбота про себе
    3 тижні оплачуваної відпустки, необмежені day off та гнучкі sick leaves без зайвої бюрократії. Також ви можете обрати медичне страхування або wellness-бюджет на спорт, психолога, масажі, wellness-процедури чи вітаміни. Додатково компенсуємо 50% податків для співробітників та надаємо повний супровід релокації на Кіпр або Мальту, включно з бухгалтерською і юридичною підтримкою.
  • Середовище для зростання
    Ми підтримуємо професійний розвиток співробітників та компенсуємо від 50% до 100% вартості профільних конференцій, тренінгів, сертифікацій, онлайн-курсів і зовнішніх освітніх заходів. У компанії працюють власна LMS-платформа, бібліотека та книжковий клуб. Крім того, наші сертифіковані коучі проводять внутрішні навчання та індивідуальні коуч-сесії, допомагаючи розвивати лідерські навички, досягати професійних цілей і краще розуміти власні сильні сторони. Для розвитку міжнародної комунікації компенсуємо 70% вартості індивідуальних занять з будь-якої іноземної мови та підтримуємо English Speaking Club.
  • Вплив, який відчутний
    У нас немає ролей «для процесу». Ми цінуємо людей, які бачать можливості, беруть відповідальність і впливають на результат. Ваші ідеї не губляться в шарах погоджень — вони можуть перетворюватися на нові продукти, напрямки та рішення для бізнесу.
  • Професійне середовище
    Ми віримо, що сильні продукти створюють сильні команди. Тут легко знайти однодумців, отримати підтримку, обмінятися досвідом і разом святкувати перемоги. Спільні спортивні активності, корпоративні тренування з волейболу, бігу та йоги, тімбілдинги, офлайн-зустрічі та внутрішні івенти — від камерних вечорів до масштабних виїзних заходів — є важливою частиною нашої культури. Атмосферу наших івентів можна відчути тут YouTube Galaktica.
🔗 Дізнайся більше про нас:
🌐 Galaktica — офіційний сайт
📸 Instagram (@galakticateam) — команда та процес зсередини
🎥 Galaktica. Візитівка — відео-візитівка
Будемо раді обговорити всі ваші запитання та запросити на перший етап співбесіди!
Наголошуємо, у разі зацікавленості команди у вашій кандидатурі, ми зв’яжемося будь-яким зручним способом для детального обговорення нашої вакансії!

See also

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available