Zum Inhalt springen
emagine Polska

Data Engineer

emagine Polska Alle Angebote ansehen
158 PLN / Stunde
Warsaw
Warszawa
Stockholm Metropolitan Area
Brussels
+5
vor 1 Monat

Kurzfassung

Data Engineer sought for building a new data ecosystem on GCP for a major Polish bank. Responsibilities include data pipelines (dbt, Airflow), Python/PySpark development, BigQuery lakehouse, CI/CD, and data governance. Hybrid work in Warsaw.

Von KI erstellte Kurzfassung des Anzeigentextes.

Informacje o projekcie:

Branża: Bankowość

Umowa: B2BStawka: do 158 pln/h netto +vatLokalizacja: hybryda Warszawa - 2 x tydzień Wprowadzenie i podsumowanie:

Poszukujemy ekspertów, którzy chcą współtworzyć nowy ekosystem danych w jednym z największych banków w Polsce. Celem tej roli jest wdrożenie nowoczesnej platformy danych na Google Cloud Platform (GCP), budowa rozwiązania klasy data lakehouse oraz integracja obszarów raportowania, analityki oraz zarządzania danymi, w ramach strategicznego programu „data-driven bank”.

Główne obowiązki obejmują:

Budowa i utrzymanie pipeline'ów danych w dbt oraz orkiestracja przepływów w Airflow.

Rozwój komponentów przetwarzania danych w Pythonie oraz PySpark.

Projektowanie i rozwój warstw Gold i Platinum platformy lakehouse w BigQuery.

Optymalizacja wydajności i kosztów w BigQuery.

Budowa i utrzymanie procesów CI/CD oraz infrastruktury jako kodu.

Implementacja modelu bezpieczeństwa danych.

Współtworzenie standardów Data Governance.

Udział w code review i kształtowaniu standardów pracy zespołu.

Konsultacje techniczne dla zespołów domenowych oraz promowanie dobrych praktyk inżynierii danych na GCP.

Wymagania:

Min. 5 lat doświadczenia komercyjnego w inżynierii danych, w tym min. 2 lata w projektach opartych o Google Cloud Platform.

Udział w projektowaniu i wdrożeniu hurtowni danych w środowisku produkcyjnym o dużej skali.

Umiejętność projektowania rozwiązań end-to-end i uzasadniania decyzji architektonicznych.

SQL (poziom zaawansowany) — złożone zapytania analityczne.

Python (poziom zaawansowany) — programowanie obiektowe, pisanie modułów produkcyjnych.

Znajomość Google Cloud Platform: IAM, Cloud Storage, Cloud Logging/Monitoring.

BigQuery — projektowanie schematów, optymalizacja kosztów.dbt (Core lub Cloud) — budowanie modeli, dokumentacja.

Apache Airflow — projektowanie DAG-ów produkcyjnych.

Apache Spark — pisanie zadań PySpark.

CI/CD — Git

Hub Actions, automatyzacja testów.

Git — biegłość w pracy z gałęziami.

Mile widziane:

Infrastructure as Code — Terraform.

Data Governance / Knowledge Catalog — Dataplex, zarządzanie metadanymi.

Docker — konteneryzacja aplikacji.

FinOps — optymalizacja kosztów w GCP.

Architektura medallion / data mesh.

Certyfikaty GCP — Professional Data Engineer.

Szczegóły kontekstu:

Praca w projekcie skupionym na budowie ekosystemu danych w chmurze, z zespołem w modelu hub & spoke.

Veröffentlicht 2026-08-12
Läuft ab 2026-11-10
Quelle