IT Operations Engineer

Ework GroupGdańsk, Warszawanofluffjobspublicada el 21/08/2026
Imprescindible:PythonGitDockerKubernetesAgileCI/CD

Daily tasks

  • Zarządzanie incydentami i problemami : odpowiedzialność za proces RCA (Root Cause Analysis, analiza przyczyn źródłowych) dla incydentów produkcyjnych: diagnozowanie problemów, ich rozwiązywanie oraz wdrażanie działań zapobiegawczych, aby nie występowały ponownie.
  • Monitorowanie i wsparcie środowiska produkcyjnego : ciągłe monitorowanie kondycji usług, wczesne wykrywanie anomalii oraz reagowanie, zanim przerodzą się w incydenty.
  • Realizacja wdrożeń : projektowanie, wdrażanie i utrzymywanie potoków CI/CD z wykorzystaniem GitHub Actions oraz powiązanych narzędzi w celu automatyzacji procesów budowania, testowania, skanowania bezpieczeństwa i wdrażania aplikacji.
  • Nadzór nad środowiskami: utrzymywanie stabilności i spójności środowisk Pre-Production oraz Production. Nie chodzi o ich budowanie od podstaw, ale o zapewnienie ich prawidłowego działania na co dzień.
  • Zarządzanie dokumentacją i wiedzą: dokumentowanie procedur operacyjnych, znanych problemów oraz sposobów ich rozwiązywania w celu budowania wiarygodnej bazy wiedzy dla zespołu.
  • Współpraca międzyzespołowa: ścisła współpraca z zespołami deweloperskimi i platformowymi przy analizie oraz rozwiązywaniu problemów, doprecyzowywaniu wymagań operacyjnych oraz zapewnianiu przepływu informacji pomiędzy środowiskiem produkcyjnym a zespołami developerskimi.

Requirements

Minimum 5 lat doświadczenia w obszarze operacji IT, wsparcia aplikacji (2. i 3. linia wsparcia) lub na podobnym stanowisku związanym z utrzymaniem środowisk produkcyjnych. Doświadczenie w kompleksowym zarządzaniu incydentami od momentu zgłoszenia/alarmu, przez analizę przyczyn źródłowych (RCA), aż po wdrożenie działań zapobiegawczych. Minimum 2 lata doświadczenia w pracy zgodnie z frameworkiem ITIL (zarządzanie incydentami, problemami i zmianami). Doświadczenie w pracy w środowisku Agile we współpracy z zespołami deweloperskimi. Bardzo dobra znajomość języka angielskiego (minimum C1), umożliwiająca jasne komunikowanie zagadnień technicznych zarówno specjalistom IT, jak i osobom nietechnicznym. Bardzo dobra znajomość Jenkins w zakresie tworzenia i utrzymywania pipeline'ów oraz realizacji i rozwiązywania problemów związanych z wdrożeniami. Bardzo dobra znajomość procesów CI/CD , w tym ich automatyzacji oraz ciągłego usprawniania. Bardzo dobre umiejętności analityczne i rozwiązywania problemów, pozwalające samodzielnie diagnozować złożone problemy produkcyjne. Znajomość narzędzi do analizy logów i monitorowania alertów: Splunk, Sysdig . Znajomość narzędzi observability: Prometheus, Grafana (odczytywanie dashboardów, dostrajanie alertów). Doświadczenie w pracy z usługami działającymi na Kubernetesie (sprawdzanie stanu podów, analiza logów, restartowanie usług; bez administracji klastrami). Bardzo dobra znajomość Ansible do wdrażania zmian konfiguracyjnych w kontrolowanych scenariuszach operacyjnych. Dobra znajomość Docker i Docker Compose . Podstawowe umiejętności skryptowania w Bash i Pythonie w celu automatyzacji powtarzalnych zadań operacyjnych oraz uzgadniania/rekoncyliacji danych.

Must have: Jenkins, CI/CD, Splunk, Sysdig, Prometheus, Grafana, Kubernetes, Ansible, Docker, Docker Compose, Bash, Python