ITLT

Senior Site Reliability Engineer (Azure, Monitoring & Observability)

Remote · Posted 2w ago

salary not listedseniorfreelanceremote
AzureKubernetesAKSKafkaGrafanaPrometheusLokiThanosTerraformGitHub ActionsAzure DevOpsPythonShellDatabricksAzure SQL ServerFivetranApache Flink

Job Description

W ITLT pomagamy naszym zaprzyjaźnionym firmom przekształcać ambitne pomysły w cyfrową rzeczywistość. Z nastawieniem na wyzwania, ciekawość technologii i zwinność współtworzymy wyjątkowe rozwiązania IT i zapewniamy doświadczone osoby eksperckie, które pomagają przyspieszać cyfrową transformację.Aktualnie poszukujemy profilu na stanowisko: Senior Site Reliability Engineer (Azure, Monitoring & Observability)Budujemy niewielki, 2–3-osobowy zespół odpowiedzialny za stworzenie i rozwój platformy Monitoring & Observability (M&O) oraz Data Quality dla całej organizacji.Jako Senior Site Reliability Engineer będziesz odpowiadać za projektowanie, budowę i rozwój platformy M&O w środowisku Azure i data platform. Twoim zadaniem będzie rozwój monitoringu aplikacji, infrastruktury i danych, proaktywne wykrywanie problemów, alerting, analiza metryk, logów i trace’ów oraz automatyzacja procesów operacyjnych.Informacje organizacyjne:Tryb realizacji usług: 100% zdalnieStart: ASAPForma współpracy: kontrakt b2b, zaangażowanie stabilne, długofaloweJęzyk angielski: wymagany na poziomie zaawansowanym (C1) - codzienna współpraca w międzynarodowym środowiskuSektor: FMCGZakres zadań:Projektowanie i rozwój platformy Monitoring & Observability dla środowiska Azure/data platformMonitoring aplikacji, infrastruktury i Kubernetes/AKS oraz konfiguracja alertinguAnaliza metryk, logów i trace’ów, troubleshooting oraz root cause analysisBudowanie mechanizmów proaktywnego wykrywania problemów i anomaliiDbanie o reliability, availability, stability i performance środowisk produkcyjnychAutomatyzacja procesów operacyjnych oraz rozwój Infrastructure as Code i CI/CDUdział w incident management oraz wdrażaniu praktyk Site Reliability EngineeringOptymalizacja wykorzystania zasobów i kosztów Azure (FinOps)Oczekiwania:Min. 5 lat doświadczenia w obszarze Site Reliability Engineering / DevOps / Cloud Engineering (w tym doświadczenie na stanowisku SRE)Bardzo dobra znajomość Microsoft Azure oraz doświadczenie w pracy z infrastrukturą produkcyjnąPraktyczna znajomość Kubernetes, w szczególności Azure Kubernetes Service (AKS)Doświadczenie z Kafka, w szczególności Kafka on AKSBardzo dobra znajomość narzędzi Monitoring & Observability, w szczególności Grafana Enterprise / Grafana Cloud, Prometheus, Loki i ThanosDoświadczenie w pracy z metrics, logs & traces, tworzeniu dashboardów oraz konfiguracji alertinguDobra znajomość praktyk SRE, w tym incident management, troubleshooting, root cause analysis oraz performance monitoring i optimizationDoświadczenie z Infrastructure as Code, w szczególności TerraformPraktyczna znajomość CI/CD, w szczególności GitHub Actions i/lub Azure DevOps / ADO PipelinesUmiejętność automatyzacji z wykorzystaniem Python i Shell scripting Mile widziane:Znajomość DatabricksDoświadczenie z Azure SQL ServerZnajomość FivetranZnajomość Apache FlinkOferujemy:Długofalowa, stabilna współpraca w oparciu o kontrakt B2BSzansa na rozwój w dużej strukturze, bezpośredni kontakt z Managerem zespołuWspółpraca z ekspertami w firmie, w której IT jest dojrzałe i globalne, a metodyki zwinne są respektowaneDopłata do karty MultiSport oraz ubezpieczeniaSprawny proces rekrutacyjny (wideokonferencja), maksymalnie 2 spotkania online (pierwsze z kimś z zespołu, drugie z Managerem) Agencja zatrudnienia - nr certyfikatu 14181