2025
Craft AI — Plateforme IA, Paris
Novembre 2025 → aujourd'hui
AI Platform Engineer
En CDI sur une plateforme IA en production, je gère le cycle complet de développement, déploiement et monitoring de modèles ML et LLM.
- Refonte de l'architecture IaC : migration et consolidation de +30 modules Terraform vers une structure modulaire v2 multi-provider — moins de duplication, onboarding plus rapide sur de nouveaux environnements.
- Gestion d'infrastructure multi-cloud (AWS, GCP, Scaleway) sur 50+ environnements clients : harmonisation des conventions de nommage, variables et outputs entre les 3 providers pour garantir cohérence et maintenabilité à l'échelle.
- Stack de monitoring AI/ML complet : Prometheus (métriques infra), Grafana (dashboards temps réel), OpenObserve (agrégation de logs).
- Optimisation des coûts cloud : audit AWS complet, Reserved Instances, rightsizing EC2/RDS — 30% de dépenses mensuelles en moins.
- Collaboration étroite avec les équipes Data Science : productionisation des modèles, optimisation de la latence d'inférence, amélioration du pipeline ML.
- Automatisation du déploiement des modèles ML via GitHub Actions : CI/CD complet avec tests automatisés, validation des modèles et déploiement progressif.
- Documentation de l'architecture MLOps : diagrammes d'infrastructure, runbooks opérationnels et guides de troubleshooting.
2022
Wethenew — Startup, e-commerce sneakers premium, Paris
Juillet 2022 → Janvier 2025
DevOps Engineer
En mission d'ingénieur DevOps sur une plateforme e-commerce de sneakers premium : infrastructure cloud AWS et automatisation DevOps.
- Diagnostic & résolution d'incidents : analyse et résolution d'incidents en production et développement (erreurs applicatives, problèmes de déploiement, dégradations de performance) via New Relic et AWS CloudWatch.
- Provisioning automatisé (IaC) : environnements de développement, services ECS et instances EC2 automatisés avec Terraform.
- Administration AWS IAM : gestion des comptes, groupes, rôles, politiques d'accès et permissions pour sécuriser les environnements cloud.
- Scripts Bash d'automatisation : opérations récurrentes — sauvegardes et restaurations de bases de données, contrôle des accès aux bases de production.
- Administration MySQL : gestion des utilisateurs, bases, tables, droits d'accès et privilèges applicatifs.
- CI/CD GitHub Actions & Docker : création et maintenance de Dockerfiles et de workflows GitHub Actions pour l'intégration et le déploiement continus.
- Optimisation des pipelines CI/CD : fiabilité des déploiements, rapidité des livraisons et stabilité des environnements.
- Intégration DevOps ↔ Slack : fluidification des approbations, centralisation des alertes New Relic, suivi des taux d'erreur et monitoring de la santé plateforme.
- Fonctions AWS Lambda (Python) : automatisation et optimisation de workflows opérationnels.
- Documentation DevOps sur Notion : procédures d'exploitation, diagrammes d'infrastructure, accès bases de données, tutoriels de monitoring et process internes.
2020
Data Service Group — IT Business Consulting, Delaware (États-Unis)
Janvier 2020 → Mars 2022
Linux SysAdmin & DevOps
Administration systèmes Linux et automatisation DevOps pour une infrastructure distribuée multi-serveurs.
- Administration systèmes Linux : gestion des comptes utilisateurs et permissions en CLI, monitoring des performances système (CPU, RAM, disque), analyse des logs pour le troubleshooting.
- Automatisation de la maintenance : scripts Bash de mises à jour système et patches de sécurité automatiques — temps de maintenance réduit de 70%.
- Configuration des systèmes de fichiers : partitionnement des disques, montage NFS, gestion des quotas, optimisation des I/O.
- Scripts Bash avancés : automatisation des tâches d'administration (rotation des logs, cron jobs, backups incrémentaux) et monitoring de la santé des serveurs avec alerting.
- Configuration de serveurs web : installation et optimisation d'Apache et Nginx (sites statiques et dynamiques), configuration SSL/TLS, load balancing.
- Sécurité réseau : règles de pare-feu (iptables, security groups), hardening SSH, gestion des certificats.
- Accès distant sécurisé : SSH par authentification à clés, gestion des authorized_keys, bastion hosts.
- Déploiement de machines virtuelles : création et gestion de VMs avec VirtualBox et VMware pour les environnements dev/test, templates réutilisables.
- Stratégies backup / recovery : solutions de sauvegarde automatisées, tests de restauration réguliers, procédures de disaster recovery documentées.
- Documentation technique : guides de configuration système, procédures de troubleshooting, documentation d'architecture pour l'équipe.