Senior Data Engineer - K/M
Коротко
Designs and implements scalable data engineering solutions, ETL/ELT processes, and streaming data processing using Databricks, PySpark, and FastAPI. · Needs: 7+ years in Data Engineering, Python, FastAPI, Databricks, PySpark, SQL, Delta Lake, Unity Catalog migrations, Oracle, SQL Server, Informatica, BFSI sector
Описание от работодателя
Praca w modelu hybrydowym: 3 dni w tygodniu z biura w Krakowie. Współpraca w modelu B2B. Poszukujemy osoby z minimum 7-letnim doświadczeniem, która samodzielnie projektuje i wdraża skalowalne rozwiązania Data Engineering oraz wspiera inicjatywy związane z modernizacją platform danych.
Daily tasks:
- Tworzenie i rozwijanie usług oraz integracji opartych o FastAPI.
- Budowanie skalowalnych procesów ETL/ELT z wykorzystaniem Databricks i PySpark.
- Prowadzenie migracji do Unity Catalog oraz inicjatyw związanych z modernizacją platform danych.
- Wdrażanie i optymalizacja rozwiązań do przetwarzania strumieniowego danych w czasie rzeczywistym.
- Współpraca z zespołami biznesowymi i technologicznymi przy dostarczaniu rozwiązań klasy enterprise.
- Projektowanie i implementacja nowoczesnych rozwiązań data engineeringowych odpowiadających na potrzeby organizacji.
Posiadasz minimum 7 lat doświadczenia w obszarze Data Engineering oraz programowaniu w Pythonie.
Masz praktyczne doświadczenie w tworzeniu i rozwijaniu API z wykorzystaniem FastAPI.
Bardzo dobrze znasz Databricks, PySpark, SQL oraz Delta Lake.
Posiadasz doświadczenie w migracjach do Unity Catalog.
Pracowałeś/-aś z Databricks Structured Streaming oraz rozwiązaniami do przetwarzania danych w czasie rzeczywistym.
Masz doświadczenie w pracy z bazami Oracle i SQL Server oraz narzędziem Informatica.
Potrafisz samodzielnie projektować i wdrażać skalowalne rozwiązania data engineeringowe.
Znasz specyfikę sektora Banking, Financial Services & Insurance (BFSI).
Mile widziane: Doświadczenie w pracy z chmurą Azure oraz administracją Databricks.
Znajomość narzędzi i procesów CI/CD.
Doświadczenie z Git, Azure DevOps lub GitLab.
Umiejętność tuningu wydajności i optymalizacji rozwiązań Spark.
Doświadczenie w prowadzeniu działań technicznych oraz współpracy z interesariuszami.
Certyfikaty Databricks.
Must have: Python, SQL, Spark, FastAPI, Databricks
Nice to have: Azure, Azure DevOps Server, GitLab