Inżynier/ka Danych
- Min. 5 lat doświadczenia komercyjnego w inżynierii danych, w tym min. 2 lata w projektach opartych o Google Cloud Platform
- Udział w projektowaniu i wdrożeniu hurtowni danych / data lakehouse w środowisku produkcyjnym o dużej skali
- Umiejętność projektowania rozwiązań end-to-end i uzasadniania decyzji architektonicznych
- Komunikatywność i umiejętność współpracy z analitykami, data scientistami oraz stakeholderami biznesowymi
- SQL (poziom zaawansowany) — złożone zapytania analityczne, window functions, CTE, optymalizacja zapytań, modelowanie danych
- Python (poziom zaawansowany) — programowanie obiektowe, pisanie modułów produkcyjnych, testy jednostkowe, praca z bibliotekami do przetwarzania danych (pandas, numpy)
- Google Cloud Platform — praktyczna znajomość ekosystemu GCP: IAM, Cloud Storage, Secret Manager, Cloud Logging/Monitoring
- BigQuery — projektowanie schematów, partycjonowanie i klastrowanie tabel, optymalizacja kosztów i wydajności zapytań
- dbt (Core lub Cloud) — budowanie modeli, makra, testy, snapshoty, dokumentacja
- Apache Airflow — projektowanie DAG-ów produkcyjnych, orkiestracja pipeline'ów dbt i zadań GCP
- Apache Spark — pisanie zadań PySpark, optymalizacja jobów
- CI/CD — GitHub Actions, automatyzacja testów i deploymentu pipeline'ów danych
- Git — biegłość w pracy z gałęziami, pull requestami, code review, git flow