(Podsumowanie wygenerowane przez AI na bazie pełnej treści ogłoszenia rekrutacyjnego)
Projekt dotyczy budowy Data Lakehouse dla sektora finansowego z fokus na rekonsyliację i synchronizację danych w warstwie ODS. W projekcie używane są przede wszystkim Apache Spark (PySpark, Spark SQL), MongoDB z MongoDB Spark Connector, oraz technologie warstw danych takie jak Delta Lake / Iceberg / Hudi. Do monitoringu stosowane są Prometheus, Grafana i narzędzia APM/OpenTelemetry, a deploymenty realizowane są na Docker/Kubernetes (Spark Operator). Odpowiedzialność obejmuje projektowanie i implementację procesów Spark do walidacji i porównywania danych, implementację reguł jakości danych, detekcję duplikatów i anomalii, projektowanie przepływu Raw→Bronze→Silver→Gold, integrację i optymalizację Spark–MongoDB, wdrożenia CI/CD (Jenkins), monitoring SLA/SLO, automatyzację deploymentów, diagnozowanie problemów oraz tworzenie dokumentacji i runbooków. Oferowane benefity obejmują prywatną opiekę medyczną i karta Multisport.




Klikając w przycisk „Aplikuj” potwierdzasz, że zapoznałeś(‑łaś) się i akceptujesz Regulamin serwisu.
Tak pracodawca przetwarza Twoje dane
This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.
Brakuje Ci informacji?