- Minimum 5 lat doświadczenia w obszarze operacji IT, wsparcia aplikacji (2. i 3. linia wsparcia) lub na podobnym stanowisku związanym z utrzymaniem środowisk produkcyjnych.
- Doświadczenie w kompleksowym zarządzaniu incydentami od momentu zgłoszenia/alarmu, przez analizę przyczyn źródłowych (RCA), aż po wdrożenie działań zapobiegawczych.
- Minimum 2 lata doświadczenia w pracy zgodnie z frameworkiem ITIL (zarządzanie incydentami, problemami i zmianami).
- Doświadczenie w pracy w środowisku Agile we współpracy z zespołami deweloperskimi.
- Bardzo dobra znajomość języka angielskiego (minimum C1), umożliwiająca jasne komunikowanie zagadnień technicznych zarówno specjalistom IT, jak i osobom nietechnicznym.
- Bardzo dobra znajomość Jenkins w zakresie tworzenia i utrzymywania pipeline'ów oraz realizacji i rozwiązywania problemów związanych z wdrożeniami.
- Bardzo dobra znajomość procesów CI/CD, w tym ich automatyzacji oraz ciągłego usprawniania.
- Bardzo dobre umiejętności analityczne i rozwiązywania problemów, pozwalające samodzielnie diagnozować złożone problemy produkcyjne.
- Znajomość narzędzi do analizy logów i monitorowania alertów: Splunk, Sysdig.
- Znajomość narzędzi observability: Prometheus, Grafana (odczytywanie dashboardów, dostrajanie alertów).
- Doświadczenie w pracy z usługami działającymi na Kubernetesie (sprawdzanie stanu podów, analiza logów, restartowanie usług; bez administracji klastrami).
- Bardzo dobra znajomość Ansible do wdrażania zmian konfiguracyjnych w kontrolowanych scenariuszach operacyjnych.
- Dobra znajomość Docker i Docker Compose.
- Podstawowe umiejętności skryptowania w Bash i Pythonie w celu automatyzacji powtarzalnych zadań operacyjnych oraz uzgadniania/rekoncyliacji danych.
,[Zarządzanie incydentami i problemami : odpowiedzialność za proces RCA (Root Cause Analysis, analiza przyczyn źródłowych) dla incydentów produkcyjnych: diagnozowanie problemów, ich rozwiązywanie oraz wdrażanie działań zapobiegawczych, aby nie występowały ponownie., Monitorowanie i wsparcie środowiska produkcyjnego : ciągłe monitorowanie kondycji usług, wczesne wykrywanie anomalii oraz reagowanie, zanim przerodzą się w incydenty., Realizacja wdrożeń : projektowanie, wdrażanie i utrzymywanie potoków CI/CD z wykorzystaniem GitHub Actions oraz powiązanych narzędzi w celu automatyzacji procesów budowania, testowania, skanowania bezpieczeństwa i wdrażania aplikacji., Nadzór nad środowiskami: utrzymywanie stabilności i spójności środowisk Pre-Production oraz Production. Nie chodzi o ich budowanie od podstaw, ale o zapewnienie ich prawidłowego działania na co dzień., Zarządzanie dokumentacją i wiedzą: dokumentowanie procedur operacyjnych, znanych problemów oraz sposobów ich rozwiązywania w celu budowania wiarygodnej bazy wiedzy dla zespołu., Współpraca międzyzespołowa: ścisła współpraca z zespołami deweloperskimi i platformowymi przy analizie oraz rozwiązywaniu problemów, doprecyzowywaniu wymagań operacyjnych oraz zapewnianiu przepływu informacji pomiędzy środowiskiem produkcyjnym a zespołami developerskimi.] Requirements: Jenkins, CI/CD, Splunk, Sysdig, Prometheus, Grafana, Kubernetes, Ansible, Docker, Docker Compose, Bash, Python