Scalian
Responsable d'Exploitation GCP (H/F)
Toulouse, Occitanie, fr · Posted yesterday
salary not listedseniorpermanentDept: Infra / Cloud / DevSecOps
GCPGKEKubernetesOpenShiftTerraformBashPythonGitLabBigQueryLooker StudioJiraConfluencePrometheusGrafana
Job Description
Responsable d'Exploitation / SRE
Type de contrat : CDI / Freelance
Lieu : Toulouse
Démarrage : dès que possible
Rémunération : en fonction du profil
Contexte
Au sein d'un acteur majeur du secteur aéronautique et spatial, vous intégrerez une équipe en charge du RUN d'une plateforme de production dans un environnement Cloud et hybride. La mission est principalement orientée GCP, monitoring et gestion des incidents, avec des enjeux d'amélioration continue et d'automatisation.
Missions principales
- Assurer le maintien en conditions opérationnelles de la plateforme et gérer les incidents de niveau 2/3
- Superviser la plateforme via GCP Cloud Monitoring, Logging, Metrics et Alerting
- Administrer les accès et les droits sur les différentes plateformes
- Intervenir sur les environnements GKE / Kubernetes et OpenShift
- Améliorer la supervision et mettre en place des métriques, alertes et dashboards
- Automatiser les opérations via Bash / Python
- Gérer l'infrastructure et les droits via Terraform
- Participer à l'amélioration de la CI/CD avec GitLab
- Exploiter BigQuery et Looker Studio pour certains besoins de reporting et de supervision
- Assurer le suivi et la documentation via Jira et Confluence
Compétences requises
- Bonne maîtrise de GCP, notamment GKE, Cloud Monitoring, IAM, Storage et Logging
- Solide connaissance du monitoring, des métriques et de l'alerting
- Bonne maîtrise de Kubernetes
- Bonne connaissance de Terraform
- Expérience en environnement DevOps / SRE / Platform Engineering orienté RUN
- Connaissance d'OpenShift, Prometheus et Grafana
- Maîtrise de Bash ou Python
- Connaissance de GitLab / CI-CD
- BigQuery, Looker Studio et APIs : un plus
- Expérience confirmée en DevOps, SRE, Platform Engineering ou exploitation
- Expérience significative sur GCP et des plateformes de production
- Bonnes capacités d'analyse et de résolution d'incidents
- Autonomie, rigueur et esprit d'amélioration continue
#LI-MA3