For Employers

MARGO

Senior Linux / HPC Infrastructure Engineer (SRE)

Posted 2 days ago
200 - 250 per hour
5-10 years experience
Apply Now

Please mention DailyRemote when applying

?
Resume Match Score

See how much of this job your resume covers, and what’s missing.

Want a recruiter to go through it line by line?

Get professional review

Create a cover letter for this job

Upload your resume and we draft a letter for this exact role, tailored to what it asks for.

  • Tailored to this role
  • Based on your resume
  • Fully editable
AI Summary

You will be responsible for maintaining and developing Linux-based HPC and GPU infrastructure used for AI workloads. This includes automating configurations, diagnosing system and hardware issues, and ensuring the stability of the production environment.

Szukamy doświadczonego inżyniera Linux/SRE do zespołu zajmującego się utrzymaniem i rozwojem infrastruktury HPC oraz klastrów GPU wykorzystywanych do AI.

Pracujemy na fizycznych serwerach, z Linuxem, sieciami Data Center i technologiami NVIDIA. Dużo automatyzujemy, korzystamy z Ansible, Pythona, Basha i Gita.

To nie jest typowa praca DevOps skupiona na chmurze i wdrażaniu aplikacji. Tutaj zdecydowanie więcej czasu spędza się na pracy z infrastrukturą, diagnozowaniu problemów i dbaniu o stabilność środowiska.

\n


\n
200 zł - 250 zł an hour

Czym będziesz się zajmować?

  • Utrzymaniem i rozwojem infrastruktury Linux oraz klastrów HPC/GPU.
  • Diagnozowaniem i rozwiązywaniem problemów produkcyjnych, zarówno systemowych, jak i sprzętowych czy sieciowych.
  • Automatyzacją konfiguracji i zarządzania infrastrukturą.
  • Rozwijaniem monitoringu i poprawianiem stabilności środowiska.
  • Współpracą przy wdrożeniach i rozwiązywaniu incydentów.
  • Dokumentowaniem rozwiązań i usprawnianiem codziennej pracy.

Czego oczekujemy (Hard Skills)?

  • Bardzo dobrej znajomości Linuxa Debian-like i doświadczenia z systemami produkcyjnymi.
  • Doświadczenia z bare-metal i infrastrukturą Data Center.
  • Dobrej znajomości sieci (TCP/IP, DNS, VLAN, routing).
  • Umiejętności samodzielnego diagnozowania problemów systemowych, sieciowych i wydajnościowych.
  • Znajomości Ansible, Git oraz umiejętności pisania skryptów w Bashu i Pythonie.
  • Doświadczenia z monitoringiem i narzędziami diagnostycznymi.
  • Angielskiego pozwalającego na swobodną codzienną komunikację.
\n

Mile widziane

  • Doświadczenie z HPC, klastrami obliczeniowymi lub infrastrukturą GPU.
  • Znajomość technologii NVIDIA (Cumulus, DCGM, NCCL, NHC, NVIDIA Container Toolkit).
  • Znajomość InfiniBand, RDMA, SLURM.
  • Doświadczenie z Prometheus, Grafana, GitLab CI/CD.
  • Doświadczenie z rozproszonymi i klastrowymi systemami plików (Lustre, Ceph).

Kim jesteś (Soft Skills)?

  • Potrafisz samodzielnie podejść do problemu i nie boisz się szukać rozwiązań.
  • Lubisz współpracować z innymi i potrafisz jasno komunikować, co robisz.
  • Bierzesz odpowiedzialność za swoją pracę i zmiany wprowadzane na produkcji.
  • Chętnie automatyzujesz powtarzalne zadania.
  • Nie masz problemu z pytaniem o pomoc ani dzieleniem się własną wiedzą.

Organizacja pracy

  • Około 10-osobowy zespół podzielony na część operacyjną (SRE) i projektową.
  • Godziny pracy 8:00–18:00, z dwugodzinną przerwą.
  • Praca na Linuxie lub macOS.
  • Scrum, regularne spotkania i dużo bezpośredniej komunikacji w zespole.
  • Obecnie bez dyżurów nocnych i weekendowych, ale w przyszłości planowane jest wprowadzenie rotacyjnego on-call.

Co oferujemy?

  • Pracę z dużymi klastrami GPU i infrastrukturą AI/HPC.
  • Sporo samodzielności i realny wpływ na to, jak działa infrastruktura.
  • Bezpośrednią współpracę z doświadczonymi inżynierami i Tech Leadem.
  • Możliwość poznania i rozwijania się w technologiach HPC/AI GPU.
  • Krótką ścieżkę decyzyjną, bez zbędnych formalności.

Automatically Apply to the Best Remote Jobs

Stop the endless job search. Our AI finds and applies to the best jobs for you.

Try it Now
Keep looking

Similar Jobs

See all Remote Software Development jobs →

Data Analytics Consultant

Full Time United States $69840 - $96000 per year Software Development

Sr. Software Engineer II / Tech lead, Agentic Platform (Poland, Remote, B2B)

Full Time Poland 638K - 751K per year Software Development

Web Designer ( web design + react background, 6-month contract)

Full Time Netherlands, Sweden, United Kingdom Software Development

AI Infrastructure / Product Engineer

Full Time United States $180K - $260K per year Software Development

Director of ERP Solutions

Full Time United States Software Development

Head of AI Strategy & Operations

Full Time United States $240K - $280K per year Software Development
Apply Now

Personalize your Remote Job Search in 3 Easy Steps!

Featuring 218,778+ Jobs in Software Development

Answer easy questions

Answer easy questions

218,778+ jobs across 15+ categories

Get your best job matches

Get your best job matches

Only hand-screened, legit jobs

Find a remote job faster

Find a remote job faster

No ads, scams, or junk

“I was the first applicant for a remote marketing position that got listed on the company website the same day I applied. Had an interview within 48 hours!”

Sarah J. — Sarah J. · Marketing Manager ★★★★★ Verified