← к выдаче
разработка

Senior Data Engineer - K/M

Kraków8 дн. назад

Коротко

Designs and implements scalable data engineering solutions, ETL/ELT processes, and streaming data processing using Databricks, PySpark, and FastAPI. · Needs: 7+ years in Data Engineering, Python, FastAPI, Databricks, PySpark, SQL, Delta Lake, Unity Catalog migrations, Oracle, SQL Server, Informatica, BFSI sector

Описание от работодателя

Praca w modelu hybrydowym: 3 dni w tygodniu z biura w Krakowie. Współpraca w modelu B2B. Poszukujemy osoby z minimum 7-letnim doświadczeniem, która samodzielnie projektuje i wdraża skalowalne rozwiązania Data Engineering oraz wspiera inicjatywy związane z modernizacją platform danych. Daily tasks: - Tworzenie i rozwijanie usług oraz integracji opartych o FastAPI. - Budowanie skalowalnych procesów ETL/ELT z wykorzystaniem Databricks i PySpark. - Prowadzenie migracji do Unity Catalog oraz inicjatyw związanych z modernizacją platform danych. - Wdrażanie i optymalizacja rozwiązań do przetwarzania strumieniowego danych w czasie rzeczywistym. - Współpraca z zespołami biznesowymi i technologicznymi przy dostarczaniu rozwiązań klasy enterprise. - Projektowanie i implementacja nowoczesnych rozwiązań data engineeringowych odpowiadających na potrzeby organizacji. Posiadasz minimum 7 lat doświadczenia w obszarze Data Engineering oraz programowaniu w Pythonie. Masz praktyczne doświadczenie w tworzeniu i rozwijaniu API z wykorzystaniem FastAPI. Bardzo dobrze znasz Databricks, PySpark, SQL oraz Delta Lake. Posiadasz doświadczenie w migracjach do Unity Catalog. Pracowałeś/-aś z Databricks Structured Streaming oraz rozwiązaniami do przetwarzania danych w czasie rzeczywistym. Masz doświadczenie w pracy z bazami Oracle i SQL Server oraz narzędziem Informatica. Potrafisz samodzielnie projektować i wdrażać skalowalne rozwiązania data engineeringowe. Znasz specyfikę sektora Banking, Financial Services & Insurance (BFSI). Mile widziane: Doświadczenie w pracy z chmurą Azure oraz administracją Databricks. Znajomość narzędzi i procesów CI/CD. Doświadczenie z Git, Azure DevOps lub GitLab. Umiejętność tuningu wydajności i optymalizacji rozwiązań Spark. Doświadczenie w prowadzeniu działań technicznych oraz współpracy z interesariuszami. Certyfikaty Databricks. Must have: Python, SQL, Spark, FastAPI, Databricks Nice to have: Azure, Azure DevOps Server, GitLab