Data Engineer
Kurzfassung
Data Engineer sought for building a new data ecosystem on GCP for a major Polish bank. Responsibilities include data pipelines (dbt, Airflow), Python/PySpark development, BigQuery lakehouse, CI/CD, and data governance. Hybrid work in Warsaw.
Schlüsselwörter
Von KI erstellte Kurzfassung des Anzeigentextes.
Informacje o projekcie:
Branża: Bankowość
Umowa: B2BStawka: do 158 pln/h netto +vatLokalizacja: hybryda Warszawa - 2 x tydzień Wprowadzenie i podsumowanie:
Poszukujemy ekspertów, którzy chcą współtworzyć nowy ekosystem danych w jednym z największych banków w Polsce. Celem tej roli jest wdrożenie nowoczesnej platformy danych na Google Cloud Platform (GCP), budowa rozwiązania klasy data lakehouse oraz integracja obszarów raportowania, analityki oraz zarządzania danymi, w ramach strategicznego programu „data-driven bank”.
Główne obowiązki obejmują:
Budowa i utrzymanie pipeline'ów danych w dbt oraz orkiestracja przepływów w Airflow.
Rozwój komponentów przetwarzania danych w Pythonie oraz PySpark.
Projektowanie i rozwój warstw Gold i Platinum platformy lakehouse w BigQuery.
Optymalizacja wydajności i kosztów w BigQuery.
Budowa i utrzymanie procesów CI/CD oraz infrastruktury jako kodu.
Implementacja modelu bezpieczeństwa danych.
Współtworzenie standardów Data Governance.
Udział w code review i kształtowaniu standardów pracy zespołu.
Konsultacje techniczne dla zespołów domenowych oraz promowanie dobrych praktyk inżynierii danych na GCP.
Wymagania:
Min. 5 lat doświadczenia komercyjnego w inżynierii danych, w tym min. 2 lata w projektach opartych o Google Cloud Platform.
Udział w projektowaniu i wdrożeniu hurtowni danych w środowisku produkcyjnym o dużej skali.
Umiejętność projektowania rozwiązań end-to-end i uzasadniania decyzji architektonicznych.
SQL (poziom zaawansowany) — złożone zapytania analityczne.
Python (poziom zaawansowany) — programowanie obiektowe, pisanie modułów produkcyjnych.
Znajomość Google Cloud Platform: IAM, Cloud Storage, Cloud Logging/Monitoring.
BigQuery — projektowanie schematów, optymalizacja kosztów.dbt (Core lub Cloud) — budowanie modeli, dokumentacja.
Apache Airflow — projektowanie DAG-ów produkcyjnych.
Apache Spark — pisanie zadań PySpark.
CI/CD — Git
Hub Actions, automatyzacja testów.
Git — biegłość w pracy z gałęziami.
Mile widziane:
Infrastructure as Code — Terraform.
Data Governance / Knowledge Catalog — Dataplex, zarządzanie metadanymi.
Docker — konteneryzacja aplikacji.
FinOps — optymalizacja kosztów w GCP.
Architektura medallion / data mesh.
Certyfikaty GCP — Professional Data Engineer.
Szczegóły kontekstu:
Praca w projekcie skupionym na budowie ekosystemu danych w chmurze, z zespołem w modelu hub & spoke.
| Veröffentlicht | 2026-08-12 |
| Läuft ab | 2026-11-10 |
| Quelle |
|
Hexjobs App
Auf diese Anzeige zugeschnittene Tools.
Hexjobs App
Auf diese Anzeige zugeschnittene Tools.
Ähnliche Stellen
Software Engineer III, Full Stack
DevOps Engineer
emagine Polska
WarsawChief Forward Deployed Engineer
EPAM Systems
Warsaw.NET Developers
emagine Polska
Warsaw.Net Developer, Enterprise Systems
Harvey Nash Technology
Warsaw