Rémi Le

Disponible pour de nouveaux environnements

Je maintiens en production
ce que d'autres mettent en ligne.

Ingénieur de production et DevOps, [X] ans sur des plateformes critiques. Je mets en place l'automatisation, l'observabilité et les procédures qui font qu'un système tient la charge, se répare vite et se déploie sans drame.

Indicateurs des plateformes exploitées 12 derniers mois
Disponibilité tenue 99,98 %
Délai moyen de remise en service 14 min
Déploiements par semaine 40+

Ce que j'exploite au quotidien

Organisé par couche, de l'infrastructure jusqu'à la supervision. Garde uniquement ce que tu pratiques vraiment : cinq outils maîtrisés valent mieux que vingt cités.

Infrastructure

  • AWS, OVHcloud, Infomaniak
  • Proxmox, VMware
  • Debian, RHEL
  • Réseau, DNS, TLS

Conteneurs et orchestration

  • Docker
  • Kubernetes, Helm
  • ArgoCD
  • Traefik, Nginx

Automatisation

  • Terraform
  • Ansible
  • Bash, Python
  • GitLab CI, GitHub Actions

Observabilité

  • Prometheus, Grafana
  • Loki, ELK
  • Zabbix, Centreon
  • Alerting et astreinte

Exploitation

  • Gestion d'incidents
  • Post-mortems
  • Sauvegarde et reprise
  • Mises en production

Sécurité

  • Durcissement système
  • Gestion des secrets, Vault
  • Cloisonnement réseau
  • Gestion des correctifs

Interventions

Trois situations réelles, décrites comme un post-mortem : le contexte, ce que j'ai fait, le résultat mesuré. Le détail technique est dépliable.

[Migration d'une plateforme e-commerce vers Kubernetes]

2025 · 6 mois
Contexte
Monolithe sur serveurs physiques, mises en production mensuelles le week-end, aucune capacité à absorber les pics saisonniers.
Action
Découpage en services conteneurisés, cluster décrit en Terraform, chaîne d'intégration avec déploiement progressif et retour arrière automatique.
Impact
Mises en production quotidiennes en heures ouvrées, coûts d'infrastructure réduits de 30 %, pic du Black Friday absorbé sans intervention humaine.
Détail technique

[Décris ici les choix qui ont compté : topologie du cluster, stratégie de bascule, gestion des états, ce que tu ferais différemment aujourd'hui. C'est ce paragraphe qu'un pair technique lira vraiment.]

  • Kubernetes
  • Terraform
  • ArgoCD
  • PostgreSQL
  • Prometheus

[Reprise de l'astreinte et de la supervision]

2024 · 4 mois
Contexte
Alertes trop nombreuses et peu fiables, équipe épuisée par les réveils nocturnes, pannes signalées par les clients avant l'équipe.
Action
Refonte de la supervision autour d'objectifs de service, chaque alerte reliée à une procédure écrite, tableaux de bord par domaine métier.
Impact
Alertes nocturnes divisées par quatre, détection avant le client dans 9 cas sur 10.
Détail technique

[Quels indicateurs ont remplacé quelles alertes ? Comment tu as traité les alertes héritées que personne n'osait supprimer ?]

  • Prometheus
  • Alertmanager
  • Grafana
  • Loki

[Plan de reprise d'activité enfin testé]

2023 · 3 mois
Contexte
Sauvegardes existantes mais jamais restaurées, aucun délai de reprise engageable auprès de la direction.
Action
Restaurations automatisées et vérifiées chaque semaine, procédure de bascule documentée, exercice de panne totale joué avec les équipes.
Impact
Délai de reprise ramené de « inconnu » à 2 heures, mesuré et rejoué chaque trimestre.
Détail technique

[Périmètre sauvegardé, stratégie de rétention, ce que l'exercice a révélé — c'est souvent le passage le plus convaincant.]

  • Restic
  • Ansible
  • PostgreSQL
  • Runbooks

Ce que coûte un neuf de plus

Un engagement de disponibilité se traduit en temps d'arrêt autorisé. Choisis un objectif : c'est le budget dont dispose l'équipe avant d'avoir rompu sa promesse.

Arrêt toléré par an
Par mois
Par semaine

Parcours

Du système à l'exploitation, puis à la conception des plateformes.

  • 2023 — aujourd'hui Ingénieur de production indépendantExploitation et fiabilisation de plateformes pour des PME et des éditeurs.
  • [2020 — 2023] [Ingénieur DevOps, entreprise][Industrialisation des déploiements et de la supervision.]
  • [2017 — 2020] [Administrateur systèmes, entreprise][Infrastructure Linux, virtualisation, sauvegardes.]
  • [Année] [Diplôme ou certification][École ou organisme]

Un environnement à fiabiliser ?

Audit d'infrastructure, reprise d'exploitation, migration ou mise en place d'une chaîne de déploiement. Écrivez-moi, je réponds sous 24 h.