Inference Engineer | C++ | Python | AI
Коротко
Orchestrates runtime environments, compiles graphs, and integrates systems for high-performance AI infrastructure on GPU/Linux. · Needs: 5+ years AI infrastructure or distributed systems; Python, C++; AI frameworks; GPU/Linux; technical degree; English B2+
Описание от работодателя
Lokalizacja biura: Gdańsk
Jesteś z innej części Polski? Rozważasz relokację?
Forma zatrudnienia: Umowa o pracę | 25 000 - 50 000 zł brutto | długoterminowa umowa, podpisywana bezpośrednio z klientem bez pośredników
Obszar: Półprzewodniki / Zaawansowane systemy AI
Prosimy o CV w j. angielskim
Daily tasks:
- Zespół pracuje nad systemami o ekstremalnych wymaganiach wydajnościowych, które łączą oprogramowanie niskopoziomowe z nowoczesną architekturą sprzętową dla AI.
- Poszukujemy doświadczonych inżynierów oprogramowania z dużym poczuciem odpowiedzialności technicznej, głębokim zrozumieniem systemów, w których kluczowa jest wydajność, oraz umiejętnością projektowania i optymalizowania złożonej infrastruktury od podstaw.
- Jest to praktyczne stanowisko inżynierskie skoncentrowane na orkiestracji środowiska uruchomieniowego (runtime orchestration), kompilacji grafów oraz integracji systemów. Twoje decyzje architektoniczne będą miały bezpośredni wpływ na opóźnienia (latency), wydajność oraz skalowalność systemu.
Minimum 5 lat doświadczenia w obszarze infrastruktury AI, systemów rozproszonych lub wysokowydajnych systemów backendowych
Bardzo dobra znajomość Pythona i C++
Praktyczne doświadczenie z frameworkami AI
Doświadczenie w optymalizacji wydajności obciążeń związanych z AI
Znajomość systemów wykorzystujących GPU lub inne akceleratory oraz środowiska Linux
Bardzo dobre umiejętności w zakresie debugowania i analizy wydajności na różnych warstwach systemu
Umiejętność projektowania systemów end-to-end oraz podejmowania i wdrażania decyzji architektonicznych
Wyższe techniczne wykształcenie
Angielski na poziomie min. B2+ -> międzynarodowa współpraca
Must have: Python, C++