01 Zakres zadań
- Długofalowa współpraca z międzynarodową, topową firmą consultingową, świadczącą usługi IT dla dużych i średnich firm z różnorodnych sektorów przy projekcie skupionym na budowie i optymalizacji nowoczesnych platform danych w Azure oraz Databricks.
- Projektowanie, rozwój i utrzymanie skalowalnych pipeline'ów danych oraz przetwarzanie dużych wolumenów danych dla rozwiązań analitycznych, krytycznych dla biznesu.
- Rozwój i utrzymanie potoków danych w Azure Data Factory (ADF) oraz zadań w Databricks Jobs.
- Tworzenie i integracja rozwiązań w języku Python z wykorzystaniem programowania obiektowego oraz wzorców projektowych (Factory, pipeline).
- Praca z technologiami PySpark, Delta Lake, Spark SQL oraz Azure Data Lake Storage Gen2.
- Integracja z bazami PostgreSQL oraz przetwarzanie danych szeregów czasowych (dane GPS i parametryczne).
- Stosowanie wzorców Slowly Changing Dimensions (SCD) oraz technologii CDC (Change Data Capture) i ładowania przyrostowego.
- Optymalizacja wydajności Spark w oparciu o wymogi SLA oraz konfiguracja Adaptive Query Execution (AQE).
- Realizacja wzorców migracji z SSIS do nowoczesnej architektury chmurowej.
- Wykorzystywanie narzędzia GitHub Copilot w codziennym procesie deweloperskim.
