INGÉNIEUR STOCKAGE CEPH SENIOR (F/H/X)

MetalineLevallois-Perret, Île-de-FranceOn-siteFull-timeSenior, 5–8 yearsListed 7 hours ago

Apply now

About this role

METALINE est une ESN spécialisée dans l’infogérance, les services managés, le Data Center et le Digital Work Place.

Fondée avec l’ambition d’accompagner les entreprises dans la gestion et l’optimisation de leurs infrastructures IT, METALINE a su évoluer pour répondre aux enjeux technologiques d’aujourd’hui et de demain. Dans le cadre de notre croissance et pour répondre aux besoins spécifiques de l’un de nos clients, nous recherchons un.e ingénieur.e Stockage CEPH pour une mission stratégique.

Si vous souhaitez évoluer dans un environnement dynamique et relever des défis stimulants au sein d’une équipe engagée, cette mission est faite pour vous !

Missions principales

Exploitation & administration Ceph

- Administrer et maintenir les infrastructures de stockage Ceph en production.
- Assurer le maintien en condition opérationnelle et la disponibilité des clusters.
- Superviser la capacité, les performances et la santé des clusters.
- Analyser et résoudre les incidents liés au stockage.
- Intervenir sur les problématiques liées aux OSD, MON, MGR, pools, PG et CRUSH .
- Gérer les opérations de recovery, rebalance et optimisation des clusters.
- Participer aux opérations d'évolution, de maintenance et d'upgrade de Ceph.
- Anticiper les besoins de capacité et contribuer à l'amélioration des performances.

Intégration Cloud & Kubernetes

- Assurer l'intégration de Ceph avec les plateformes OpenStack et Kubernetes .
- Travailler sur les mécanismes de stockage persistants et les interfaces CSI.
- Participer à l'exploitation de solutions Rook-Ceph / Kubernetes .
- Intervenir sur les problématiques liées au stockage objet et aux environnements S3 .
- Contribuer à l'amélioration de l'intégration entre les différents composants de la plateforme Cloud.

Production & gestion des incidents

- Prendre en charge les incidents de niveau 2/3.
- Réaliser les diagnostics techniques et analyses de causes racines.
- Participer aux astreintes et aux dispositifs de support de production.
- Respecter les engagements de service et les procédures d'exploitation.
- Participer aux changements et opérations de maintenance dans le respect des processus ITIL.
- Documenter les incidents, procédures et solutions mises en œuvre.

Automatisation & amélioration continue

- Automatiser les opérations d'administration et d'exploitation.
- Développer et maintenir des scripts et playbooks Ansible / Bash / Python .
- Contribuer à l'amélioration de la supervision et de l'observabilité.
- Participer à la standardisation des procédures et à l'industrialisation des opérations.
- Proposer et mettre en œuvre des améliorations permettant de renforcer la fiabilité, la performance et la sécurité de la plateforme.

Profil recherché

Stockage :

- Ceph
- MON / MGR / OSD / RGW
- CRUSH
- Pools / PG
- RBD / CephFS / S3

Cloud & orchestration :

- OpenStack
- Kubernetes
- Rook / Rook-Ceph
- KVM

Systèmes :

- Linux / Red Hat

Supervision & observabilité :

- Prometheus
- Grafana
- OpenSearch / ELK

Automatisation :

- Ansible
- GitHub / GitLab
- Jenkins
- Bash / Python

Stockage complémentaire :

- NetApp ONTAP

ITSM :

- ServiceNow
- ITILVous disposez d'une expérience significative en infrastructure Linux et stockage , avec une expertise confirmée sur Ceph en environnement de production .

Vous maîtrisez notamment :

L'administration et le troubleshooting Ceph.
- Les composants MON, MGR, OSD, RGW .
- CRUSH, pools, PG et mécanismes de recovery/rebalancing.
- L'intégration de Ceph avec OpenStack .
- Les environnements Kubernetes et idéalement Rook-Ceph .
- Les problématiques de stockage objet / S3.
- Linux et les outils de diagnostic système.
- La supervision et l'analyse des performances.
- L'automatisation avec Ansible et/ou scripting.

Une expérience dans un environnement Cloud, Managed Services ou production critique est fortement appréciée.

La connaissance des processus ITIL, gestion des incidents, changements et SLA est attendue.

Qualités recherchés

- Esprit d'analyse et capacité à diagnostiquer des incidents complexes.
- Autonomie et sens des responsabilités.
- Bonne communication avec les équipes techniques et métiers.
- Rigueur dans la documentation et le suivi des opérations.
- Capacité à travailler dans un environnement de production exigeant.
- Esprit d'amélioration continue.

Contraintes du poste

- Environnement de production critique.
- Participation au dispositif 5x8 / astreintes .
- Respect des procédures de changement et des engagements de service.
- Intervention sur des infrastructures soumises à des exigences fortes de sécurité, disponibilité et souveraineté des données .

Formations & Certifications

Une formation supérieure en informatique, systèmes, réseaux ou infrastructure est souhaitée.

Les certifications suivantes constituent un plus :

- Red Hat / Linux
- ITIL Foundation
- Ceph / Red Hat Ceph
- CKA / Kubernetes
- RHCE

Process de recrutement

- Premier échange téléphonique avec un Responsable recrutement Metaline
- Un Entretien Technique
- Rencontre avec le client