Postuler Contacter

Expert SRE Senior – Observabilité, Fiabilisation & Automatisation

Ref : 261002L003
Logo client
Compétences requises
Linux Control-M Oracle
Description de la mission

Contexte de la mission

Dans le cadre d’un programme de fiabilisation des environnements IT d’un grand compte, nous recherchons un Expert SRE Senior afin de renforcer la disponibilité, la stabilité et l’exploitabilité des environnements hors production.

La mission s’adresse à un profil disposant d’une expertise transverse en SRE, DevOps, systèmes, middleware, bases de données, réseaux et observabilité, capable d’analyser un existant complexe, d’identifier les points de fragilité et de mettre en œuvre des améliorations durables.

L’objectif est notamment de réduire les incidents récurrents et les temps de rétablissement, d’automatiser les opérations, de renforcer la supervision et de structurer les pratiques d’exploitation.

Principales missions

- Réaliser un diagnostic technique des environnements existants.

- Identifier les risques, dépendances, obsolescences et points uniques de défaillance.

- Analyser les causes racines des incidents et dysfonctionnements récurrents.

- Définir et piloter une feuille de route de fiabilisation.

- Automatiser les opérations récurrentes et les tâches d’exploitation.

- Mettre en œuvre des pratiques Infrastructure as Code lorsque pertinent.

- Renforcer l’observabilité : monitoring, logging, métriques, alerting et dashboards.

- Optimiser les procédures de diagnostic et de résolution des incidents.

- Améliorer la disponibilité et la performance des systèmes, middleware, bases de données et réseaux.

- Standardiser les configurations et réduire les écarts entre environnements.

- Contribuer à l’amélioration des processus de gestion des incidents, changements, configurations et capacités.

- Produire et maintenir les runbooks, procédures d’exploitation et consignes d’escalade.

- Accompagner les équipes techniques dans l’adoption de pratiques SRE durables.

- Mettre en place des indicateurs de suivi : disponibilité, incidents, MTTR, couverture de supervision.

Profil recherché

Nous recherchons un profil confirmé à expert, disposant d’une solide expérience en environnements de production ou hors production complexes.

Les compétences particulièrement recherchées sont :

- Expertise SRE.

- Très bonne maîtrise de l’observabilité.

- Solide expérience en analyse de causes racines.

- Bonne culture DevOps et CI/CD.

- Maîtrise des problématiques systèmes, middleware, bases de données et réseaux.

- Expérience de l’automatisation et de l’Infrastructure as Code.

- Expérience du monitoring, logging et alerting.

- Bonne connaissance des problématiques de disponibilité, performance et capacité.

- Expérience de la gestion des incidents et changements.

- Capacité à documenter et transférer les connaissances.

Au-delà de l’expertise technique, le consultant devra être autonome, structuré, pédagogue et capable de travailler avec des équipes techniques pluridisciplinaires.

D'autres offres
Ingénieur système Linux

Ces missions pourraient vous intéresser !

Ingénieur Systèmes Senior

Linux Reverse proxy Wallix
ASAP
93 - SAINT-DENIS
12 mois
Voir la mission

Ingénieur Linux/Windows

Linux Windows NAS SAN Kubernetes
ASAP
59 - Douai
3 mois
Voir la mission

Architecte technique EDR

Linux KVM ELK
ASAP
94 - Noisy-le-Grand
3 mois
Voir la mission

Consultant système et virtualisation

VMware ESX Linux Red Hat OpenShift Windows Windows Server 2016
ASAP
91 - Massy
3 mois
Voir la mission

Ingénieur Systèmes OS Linux

Linux LDAP VMware Ansible Kubernetes
ASAP
78 - GUYANCOURT
24 mois
Voir la mission

Ingénieur Systèmes et Réseaux

Meraki Windows Server 2016 Linux
ASAP
92 - Chatillon
6 mois
Voir la mission

Ingénieur système Linux H/F

Linux RHEL Rubrik Windows Zabbix
ASAP
92 - BOULOGNE-BILLANCOURT
36 mois
Voir la mission

ingénieur système Linux

Linux Ansible DNS Red Hat Script Shell
ASAP
78 - Saint-Quentin
36 mois
Voir la mission

Sr. Linux System Engineer

Linux Python VMware Bash Red Hat
ASAP
75 - PARIS
12 mois
Voir la mission

Ingénieur système stockage HPC

Linux Git IBM Platform HPC Grafana InfluxDB
ASAP
31 - TOULOUSE
12 mois
Voir la mission
Postuler Contacter