Przejdź do treści
Aplikuj teraz

Ta oferta jest na kilku portalach

HIBERUS POLAND SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ

Spark / Data Lakehouse Developer

HIBERUS POLAND SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Zobacz wszystkie oferty
20160 - 26880 PLN
B2B
Praca zdalna
Mid
Wrocław
Wygasa 1 paź 2026
17 dni temu

W skrócie

Remote Spark / Data Lakehouse Developer (B2B, Full-Time) in Wrocław. Responsibilities include Spark SQL/PySpark, data quality, Delta Lake/Iceberg, monitoring, and CI/CD. Requires 4+ years of Spark experience, PySpark, Spark SQL, MongoDB, Data Lakehouse, CI/CD, Python, Prometheus, Grafana, and Scrum/Kanban. Salary: 20160-26880 PLN/month.

Skrót przygotowany przez AI na podstawie treści ogłoszenia.

Technologie, których używamy

O projekcie

Twój zakres obowiązków

  • Projektowanie i implementacja procesów Spark SQL/PySpark do walidacji i porównywania danych (MongoDB/ODS).
  • Implementacja reguł jakości danych, detekcji duplikatów, anomalii i braków oraz raportowania/alertowania.
  • Integracja i optymalizacja Spark–MongoDB (MongoDB Spark Connector, partitioning, push-down, schema-aware reads).
  • Projektowanie warstwy danych Raw → Bronze → Silver → Gold z wykorzystaniem Delta Lake/Iceberg/Hudi oraz CI/CD dla schematów i migracji.
  • Monitoring i observability procesów Spark/batch/stream (Prometheus, Grafana, OpenTelemetry, Dynatrace) oraz definiowanie SLA/SLO.
  • Automatyzacja deploymentów Spark na Docker/Kubernetes (Spark Operator).
  • Diagnozowanie problemów z danymi, wydajnością i opóźnieniami procesów.
  • Tworzenie dokumentacji technicznej, runbooków i diagramów przepływu danych.
  • Współpraca w Scrum/Kanban z Data Engineerami, BA, testerami i DevOps; prowadzenie warsztatów i code review.

Nasze wymagania

  • 4+ lata doświadczenia w pracy z Apache Spark w środowisku produkcyjnym.
  • Bardzo dobra znajomość PySpark, Spark SQL, DataFrames i Structured Streaming.
  • Doświadczenie z MongoDB i Spark Connector oraz znajomość modelowania i indeksowania danych.
  • Praktyczna znajomość Apache Iceberg i architektury Data Lakehouse (upsert/merge, optymalizacja zapisów).
  • Doświadczenie w CI/CD z Jenkins, w tym automatyzacji testów i deploymentów aplikacji Spark.
  • Bardzo dobra znajomość Python oraz Spark SQL.
  • Znajomość Prometheus i Grafana w obszarze monitoringu i observability.
  • Doświadczenie w pracy w Scrum/Kanban oraz znajomość Jira i Confluence.

To oferujemy

  • Karta Multisport
  • Prywatna opieka medyczna

Benefity

Opublikowana 2026-09-01
Źródło