Implement and optimize ETL/ELT processes for data acquisition, transformation, and sharing across various business areas. Collaborate with architects and stakeholders to build and maintain data workflows using Python, SQL, and Apache Spark.
Szukamy osoby, która dołączy do jednego z projektów dla klienta z rynku DACH z branży turystycznej. Nasz zespół odpowiada za projektowanie, rozwój i utrzymanie skalowalnych rozwiązań danych w ekosystemie platformy Azure Data Platform, obejmującym m.in. Azure Synapse, Databricks oraz środowiska Data Lakehouse. Preferowany start w projekcie: listopad 2026
\n
Szukamy Ciebie, jeśli:
masz min. 5 lat doświadczenia w IT, w tym min. 3,5 roku w pracy z danymi w chmurze Azure(potwierdzone projektami komercyjnymi wdrożonymi na produkcje),
masz doświadczenie w pracy z narzędziem Terraform,
masz doświadczenie w pracy ze Databricks,
masz komercyjne doświadczenie w przetwarzaniu sporych danych przy użyciuJSON,
posiadasz komercyjne doświadczenie z PySpark,
korzystasz z SQL na poziomie zaawansowanym i wykorzystujesz go na rozwiązaniach technologicznych MS i nie tylko,
znasz metodyki i stosujesz biegle Git oraz CI/CD,
tworzysz i optymalizujesz rozwiązania przetwarzające dane (ETL, ELT, itp.) poprzedzone projektem technicznym oraz alternatywami rozwiązań (np. Apache Airflow)
potrafisz programować w Python i korzystasz z bibliotek Pandas i/lub NumPy,
jesteś zaznajomiony z narzędziami: Azure Data Explorer, Azure Data Factory, Azure Data Lake, Azure Databricks, Azure DevOps, Azure Sysnapse Analytics,
masz doświadczenie z praktykami zwinnymi oraz znasz narzędzia wykorzystywane w procesie wytwarzania oprogramowania, w tym np. Azure DevOps,
masz wiedzę na temat stosowania mechanizmów związanych z bezpiecznym przechowywaniem i przetwarzaniem danych w chmurze,
świadomie wykorzystujesz Generative AI w procesie wytwarzania oprogramowania oraz w decyzjach architektonicznych i technologicznych,
posługujesz się j. angielskim na poziomie średniozaawansowanym (min. B2) oraz swobodnie komunikujesz się w języku polskim.
Praca na tym stanowisku w naszej firmie oznacza:
Implementowanie i optymalizacja procesów ETL/ELT służących do pozyskiwania, transformacji i udostępniania danych z wielu obszarów biznesowych, w tym systemów operacyjnych, finansowych i raportowych,
tworzenie oraz utrzymywanie rozwiązań do przetwarzania danych z wykorzystaniem Python, SQL oraz Apache Spark,
wsparcie inicjatyw związanych z migracją i modernizacją środowisk danych, w tym wdrażaniem Unity Catalog, aktualizacjami platform oraz transformacjami platform danych,
budowanie i utrzymywanie workflowów w Databricks, rozwiązań opartych o Delta Live Tables (DLT), frameworków sterowanych metadanymi oraz procesów orkiestracji,
współpraca z architektami, analitykami i interesariuszami biznesowymi w celu przekładania wymagań biznesowych na solidne rozwiązania techniczne,
współtworzenie i rozwijanie procesów CI/CD, automatyzacji infrastruktury, monitoringu, logowania oraz najlepszych praktyk operacyjnych.
Doświadczenie
5 lat
Wynagrodzenie_senior
133 – 196 zł/h netto + VAT (B2B)
Typ oferty
Data Solutions
Technologie
Azure
Python
SQL
Databrics
Co oferujemy, by pracowało Ci się dobrze:
dużą swobodę działania i realny wpływ na kierunek projektów,
projekty dla klientów z Europy i USA – branża turystyczna, ubezpieczeniowa, energetyczna, farmaceutyczna i finansowa,
certyfikacje i szkolenia chmurowe: AWS, Microsoft, Databricks Academy – opłacamy szkolenia i egzaminy,
narzędzia AI dla każdego w zespole od pierwszego dnia,
społeczność ekspertów: grupy tematyczne, dostęp do zespołu architektów systemowych, analityków biznesowych i zespołu UX,
możliwość pracy 100% remote,
damy Ci merytoryczny feedback po zakończonym procesie rekrutacyjnym – niezależnie od wyniku.
“I was the first applicant for a remote marketing position that got listed on the company website the same day I applied. Had an interview within 48 hours!”