Antonio Da Fonseca
Freelance Platform & MLOps Engineer

Ingénieur DevOps freelance, 5 ans d'expérience sur des infrastructures cloud en production. Autodidacte, reconverti en 2019 sans école d'ingé. Spécialisé AWS, Kubernetes (EKS), Terraform et MLOps. J'ai industrialisé des pipelines CI/CD chez Wethenew et géré des workloads ML à 500k+ req/jour chez Craft AI. Je m'intègre dans des équipes tech, livre du travail documenté et transmissible. Disponible pour missions en remote ou Paris.

Infos pratiques
Disponibilité3 mois
TJMSur demande
LocalisationParis
Expérience5 ans
LanguesFR · EN · PT

Parcours professionnel

Des résultats mesurables, des équipes réelles.

2025
Craft AI — Plateforme IA, Paris
Novembre 2025 → aujourd'hui
AI Platform Engineer

En CDI sur une plateforme IA en production, je gère le cycle complet de développement, déploiement et monitoring de modèles ML et LLM.

  • Refonte de l'architecture IaC : migration et consolidation de +30 modules Terraform vers une structure modulaire v2 multi-provider — moins de duplication, onboarding plus rapide sur de nouveaux environnements.
  • Gestion d'infrastructure multi-cloud (AWS, GCP, Scaleway) sur 50+ environnements clients : harmonisation des conventions de nommage, variables et outputs entre les 3 providers pour garantir cohérence et maintenabilité à l'échelle.
  • Stack de monitoring AI/ML complet : Prometheus (métriques infra), Grafana (dashboards temps réel), OpenObserve (agrégation de logs).
  • Optimisation des coûts cloud : audit AWS complet, Reserved Instances, rightsizing EC2/RDS — 30% de dépenses mensuelles en moins.
  • Collaboration étroite avec les équipes Data Science : productionisation des modèles, optimisation de la latence d'inférence, amélioration du pipeline ML.
  • Automatisation du déploiement des modèles ML via GitHub Actions : CI/CD complet avec tests automatisés, validation des modèles et déploiement progressif.
  • Documentation de l'architecture MLOps : diagrammes d'infrastructure, runbooks opérationnels et guides de troubleshooting.
2022
Wethenew — Startup, e-commerce sneakers premium, Paris
Juillet 2022 → Janvier 2025
DevOps Engineer

En mission d'ingénieur DevOps sur une plateforme e-commerce de sneakers premium : infrastructure cloud AWS et automatisation DevOps.

  • Diagnostic & résolution d'incidents : analyse et résolution d'incidents en production et développement (erreurs applicatives, problèmes de déploiement, dégradations de performance) via New Relic et AWS CloudWatch.
  • Provisioning automatisé (IaC) : environnements de développement, services ECS et instances EC2 automatisés avec Terraform.
  • Administration AWS IAM : gestion des comptes, groupes, rôles, politiques d'accès et permissions pour sécuriser les environnements cloud.
  • Scripts Bash d'automatisation : opérations récurrentes — sauvegardes et restaurations de bases de données, contrôle des accès aux bases de production.
  • Administration MySQL : gestion des utilisateurs, bases, tables, droits d'accès et privilèges applicatifs.
  • CI/CD GitHub Actions & Docker : création et maintenance de Dockerfiles et de workflows GitHub Actions pour l'intégration et le déploiement continus.
  • Optimisation des pipelines CI/CD : fiabilité des déploiements, rapidité des livraisons et stabilité des environnements.
  • Intégration DevOps ↔ Slack : fluidification des approbations, centralisation des alertes New Relic, suivi des taux d'erreur et monitoring de la santé plateforme.
  • Fonctions AWS Lambda (Python) : automatisation et optimisation de workflows opérationnels.
  • Documentation DevOps sur Notion : procédures d'exploitation, diagrammes d'infrastructure, accès bases de données, tutoriels de monitoring et process internes.
2020
Data Service Group — IT Business Consulting, Delaware (États-Unis)
Janvier 2020 → Mars 2022
Linux SysAdmin & DevOps

Administration systèmes Linux et automatisation DevOps pour une infrastructure distribuée multi-serveurs.

  • Administration systèmes Linux : gestion des comptes utilisateurs et permissions en CLI, monitoring des performances système (CPU, RAM, disque), analyse des logs pour le troubleshooting.
  • Automatisation de la maintenance : scripts Bash de mises à jour système et patches de sécurité automatiques — temps de maintenance réduit de 70%.
  • Configuration des systèmes de fichiers : partitionnement des disques, montage NFS, gestion des quotas, optimisation des I/O.
  • Scripts Bash avancés : automatisation des tâches d'administration (rotation des logs, cron jobs, backups incrémentaux) et monitoring de la santé des serveurs avec alerting.
  • Configuration de serveurs web : installation et optimisation d'Apache et Nginx (sites statiques et dynamiques), configuration SSL/TLS, load balancing.
  • Sécurité réseau : règles de pare-feu (iptables, security groups), hardening SSH, gestion des certificats.
  • Accès distant sécurisé : SSH par authentification à clés, gestion des authorized_keys, bastion hosts.
  • Déploiement de machines virtuelles : création et gestion de VMs avec VirtualBox et VMware pour les environnements dev/test, templates réutilisables.
  • Stratégies backup / recovery : solutions de sauvegarde automatisées, tests de restauration réguliers, procédures de disaster recovery documentées.
  • Documentation technique : guides de configuration système, procédures de troubleshooting, documentation d'architecture pour l'équipe.

Technologies maîtrisées

Cloud
AWS GCP Scaleway
Conteneurs & orchestration
Docker Kubernetes Amazon EKS GKE Kapsule Helm ECS Cloud Run Lambda
IaC & CI/CD
Terraform Ansible CloudFormation Packer cloud-init GitHub Actions Jenkins Cloud Build Maven
MLOps & IA
Weaviate RAG CraftGPT GPT-4o Mistral Python BigQuery PostHog
Observabilité & SRE
Prometheus Grafana Loki New Relic CloudWatch OpenObserve Vector PagerDuty
FinOps
Cost Explorer DoIt Reserved Instances Spot Instances Rightsizing Quotas
Bases de données & stockage
MySQL PostgreSQL Amazon RDS Metabase S3 Cloud Storage Object Storage
Sécurité
IAM Vault Bitwarden Secrets Manager SonarQube Trivy Security Hub GuardDuty
Systèmes & réseau
Linux Nginx Apache Caddy Tomcat VPC Security Groups DNS SSH Load Balancing
Outils & collab
Bash Git VS Code Jira Notion Slack Teams Claude Code GitHub Copilot Codex

Ce que je propose en mission

01

Audit d'infrastructure

→ coûts, sécurité, performance

Analyse complète de votre infra cloud. Rapport priorisé avec actions concrètes.

AWSGCPIAMCost optimization
02

CI/CD Pipeline

→ du commit au déploiement

Pipelines robustes avec GitHub Actions ou Jenkins. Tests auto, déploiement continu, rollback.

GitHub ActionsJenkinsDocker
03

Code review DevOps

→ Dockerfile, Terraform, Bash, K8s

Review de votre config infra. Bonnes pratiques, sécurité, optimisations. Feedback écrit détaillé.

TerraformDockerfileBash
04

Mission longue durée

→ intégré dans votre équipe

Missions de plusieurs mois, gestion d'infra au quotidien, astreintes, documentation. Remote ou Paris.

MLOpsAWSKubernetesRemote OK

Projets marquants

Des livrables concrets, déployés en production.

Release Bot
Jenkins · GitHub · Notion · Slack
Automatisation
  • Bot de release automatisé : à chaque merge sur main, génération du changelog, mise à jour de la page Notion de release et notification Slack à l'équipe produit.
  • Zéro intervention manuelle à chaque déploiement, réduction des erreurs de communication entre dev et produit.
Gestionnaire d'accès base de données
Terraform · PostgreSQL · Slack
Sécurité & Accès
  • Workflow self-service via Slack : un développeur demande un accès temporaire à une BDD, validation automatique selon le rôle, credentials générés et révoqués après expiration.
  • Suppression des accès permanents en clair, traçabilité complète des connexions, conformité renforcée.
Stack d'observabilité complète
Prometheus · Grafana · OpenObserve · Slack
Monitoring
  • Mise en place d'une stack de monitoring unifiée : métriques infrastructure (Prometheus + Grafana), agrégation de logs (OpenObserve), alertes contextualisées sur Slack avec runbook intégré.
  • Visibilité temps réel sur la santé des instances, MTTR réduit significativement.
FinOps Dashboard sur mesure
AWS Cost Explorer · Python · Grafana
FinOps
  • Dashboard de visualisation des coûts cloud par service, environnement et équipe, avec alertes automatiques sur les anomalies de consommation.
  • Identification de ressources orphelines et de snapshots inutilisés, économies réalisées dès la première semaine d'usage.

Questions fréquentes

Travaillez-vous en remote et à l'international ?

Oui. Je travaille à distance pour des clients partout dans le monde, en français ou en anglais. Basé à Paris, je m'adapte à ton fuseau horaire et à ton organisation.

Quels sont vos domaines d'expertise DevOps et MLOps ?

Infrastructure cloud AWS et GCP, Kubernetes (EKS), Terraform, CI/CD, MLOps et automatisation. J'industrialise des pipelines et fiabilise des applications en production.

Comment se déroule une mission freelance ?

Premier échange pour cadrer le besoin, proposition claire, puis intégration dans ton équipe. Je livre un travail documenté et transmissible, en remote ou ponctuellement sur site.

Quel est votre TJM ?

Sur demande, selon la mission et sa durée. Contacte-moi pour un devis adapté à ton besoin.

Parlons de votre projet

Disponible pour missions en remote, partout dans le monde (ou sur site à Paris). Je réponds sous 24h, en français ou en anglais.