(Podsumowanie wygenerowane przez AI na bazie pełnej treści ogłoszenia rekrutacyjnego)
Projekt dotyczy budowy i utrzymania rozwiązań Lakehouse w Azure Databricks z wykorzystaniem PySpark, Delta Lake i Unity Catalog. Wymagana praktyczna praca z Spark Structured Streaming, CDC (Debezium/Kafka) oraz integracja z relacyjnymi bazami (Oracle, SQL Server, PostgreSQL). Odpowiedzialność obejmuje projektowanie pipeline’ów batchowych i strumieniowych, materializację warstw Medallion (bronze/silver/gold), zapewnienie idempotentności, deduplikacji i poprawnej kolejności zdarzeń, optymalizację wydajności i kosztów, monitoring i alertowanie, opis danych w katalogu OpenMetadata oraz utrzymanie kodu w GitLab z CI/CD.

Mile widziane



Klikając w przycisk „Aplikuj” potwierdzasz, że zapoznałeś(‑łaś) się i akceptujesz Regulamin serwisu.
Tak pracodawca przetwarza Twoje dane
This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.
Brakuje Ci informacji?