Spark / Data Lakehouse Developer
NATEK POLAND
Zobacz wszystkie oferty
B2B
Praca zdalna
Mid
Senior
Wrocław
Wygasa 2 paź 2026
16 dni temu
W skrócie
Spark / Data Lakehouse Developer role. Responsibilities: build PySpark/Spark-SQL pipelines, integrate Spark+MongoDB, manage data structures (Raw→Gold), tune Spark jobs, automate deployments. Requires 4+ years Big Data exp, PySpark, Spark-SQL, MongoDB integration, Apache Iceberg. Remote, B2B, Wrocław. Benefits incl. medical care, Multisport.
Skrót przygotowany przez AI na podstawie treści ogłoszenia.
Technologie, których używamy
O projekcie
Tak organizujemy naszą pracę
Tak pracujemy
Twój zakres obowiązków
- Tworzenie potoków PySpark/Spark-SQL porównujących dane ODS (MongoDB) ze źródłami oraz wdrożenie automatycznych testów jakości, wykrywania anomalii i alertów
- Integracja Spark + MongoDB, otymalizacja wymiany danych (read/write, schema inference, partitioning, push-down zapytań $match)
- Budowa i wersjonowanie wielowarstwowej struktury danych (Raw → Bronze → Silver → Gold) z wykorzystaniem Apache Iceberg / Delta Lake / Hudi.
- Strojenie jobów Spark (AQE, broadcast joins, caching) w celu przyspieszenia przetwarzania i redukcji kosztów
- Automatyzacja wdrożeń (Docker, Kubernetes, Spark Operator, Jenkins CI/CD) oraz konfiguracja monitoringu procesów (Prometheus, Grafana, OpenTelemetry, Dynatrace)
- Udział w pracach zespołu (Scrum/Kanban), code-review, prowadzenie warsztatów oraz tworzenie dokumentacji technicznej i run-booków
Nasze wymagania
- 4+ lat doświadczenia w budowaniu i wdrażaniu rozwiązań Big Data na środowiskach produkcyjnych
- Biegła znajomość PySpark, Spark-SQL, DataFrames oraz Structured Streaming
- Doświadczenie w integracji Sparka z MongoDB (MongoDB Spark Connector), praktyczna znajomość modelowania dokumentowego i strategii indeksowania
- Praktyczne doświadczenie w zarządzaniu tabelami wersjonowanymi przy użyciu Apache Iceberg (optymalizacja zapisów, operacje MERGE/UPSERT)
- Znajomość narzędzia Jenkins do automatyzacji budowania, testowania (Spark-unit, testy integracyjne) i wdrażania aplikacji Spark
- Znajomość stosu Prometheus + Grafana pod kątem śledzenia pracy procesów przetwarzania danych
- Praca w zwinnych metodologiach (Scrum / Kanban) z wykorzystaniem narzędzi Jira / Confluence
To oferujemy
- Długofalowa współpraca oparta o nasze wartości: edukacja, partnerstwo i odpowiedzialność,
- Praca w projektach dedykowanych dla największych marek na świecie z sektora finansowego i telekomunikacyjnego,
- Możliwość wymiany doświadczeń w międzynarodowych środowisku i rozwoju w projektach realizowanych w Polsce, lub innych krajach: Słowacja, Czechy, Bułgaria,
- Praca w nowoczesnym środowisku z innowacyjnymi technologiami,
- Elastyczne godziny pracy,
- Prywatna opiekę medyczną,
- Karta Multisport lub My Cafeteria,
- Ubezpieczenie na życie,
- NATEK loyalty Club,
- Możliwość dołączenia do społeczności odpowiedzialnej społecznie i uczestniczenia w inicjatywach firmowych.
Tak pracujemy nad projektem
Benefity
| Opublikowana | 2026-09-02 |
| Źródło |
|
Hexjobs App
Narzędzia dopasowane do tej oferty.
Pozostało 14 dni
02.10.2026
Hexjobs App
Narzędzia dopasowane do tej oferty.
Podobne oferty
Data Engineer – Azure Databricks
Cyclad
Wrocław, dolnośląskieStaff Software Engineer
Scalo Sp. z o.o.
Wrocław, dolnośląskieSenior QA Engineer / Specjalista ds. Testów Oprogramowania
NetTeam Solutions S.A.
Wrocław, dolnośląskieAutomation Tester with Java and Kafka (f/m/x)
Sii Sp. z o.o.
Wrocław, dolnośląskieSenior Java Developer (AI & LLM) (K/M)
NEONTRI SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ
Wrocław, dolnośląskie