Ingénieur plateforme solo chez KissMetrics
Mission en cours : reprise solo (augmentée par agents IA) de l'infrastructure d'un SaaS d'analytics américain — audit converti en contrat, modernisation sans interruption, facture cloud réduite d'un cinquième, et un client qui comprend à nouveau son système.
Mission en cours pour KissMetrics, SaaS d'analytics comportementale américain dont la plateforme a ~15 ans. D'abord un audit d'infrastructure de quelques semaines (février 2026, restitué en 18 investigations écrites), puis un contrat de six mois signé fin avril, structuré en deux pistes — fiabiliser et sécuriser le socle, accélérer le chemin de requête client — avec des critères de succès chiffrés par jalon. Terrain hérité : composants en fin de vie, observabilité quasi absente, des fondations à consolider, et un enjeu de soutenabilité économique de l'infrastructure. Depuis août 2026, la mission se poursuit en régime de maintenance : je suis disponible pour une nouvelle mission, à temps plein ou à temps partiel.
- de legacy repris et modernisé, sans interruption
- ~15 ans
- de facture cloud en 3 mois, vérifié sur factures
- ≈ −20 %
- de contrat gagnés par un audit
- 6 mois
Technique & responsabilité
Repris seul la responsabilité de l'infrastructure d'un SaaS en production — exploitation, sécurité, coûts, évolutions — sur deux clouds, en prise directe avec la direction. Une personne, augmentée d'agents IA, sur un périmètre qui occupait autrefois une équipe.
l'infrastructure entière sous une seule responsabilité, ~6 mois d'activité soutenue
TerraformAnsibleHelmKubernetesDigitalOceanAWSInfrastructure as Codeopérations soloConsigné chaque décision et chaque risque par écrit : plus d'une centaine de registres de décision, autant d'investigations, des procédures d'exploitation et des restitutions régulières — un système auditable, qui ne dépend pas de ma présence.
~220 000 lignes de documentation structurée en 6 mois — l'audit trail comme livrable
architecture decision recordsdocumentationgestion des risquescommunication écriteDevenu l'unique mainteneur d'un système de quinze ans dont les auteurs étaient partis : compris le code hérité, puis modernisé les composants critiques en fin de vie, un à un, sans interruption visible pour les clients.
~15 ans d'héritage repris, compris, modernisé — en continuité de service
legacylecture de code héritémodernisationcontinuité de serviceMigré la base de données clients depuis une version en fin de vie — sans sauvegarde ni bascule de secours — vers un service managé en haute disponibilité : quelques minutes d'indisponibilité en écriture seulement, zéro requête cassée, une base dégraissée d'un facteur dix.
bascule en quelques minutes, zéro régression, base ÷10
MySQLmigration de donnéeshaute disponibilitégestion du risqueRedonné à voir : d'un système presque sans alertes fiables à des dizaines de tableaux de bord — dont un par type de lecteur : direction, développeur, données, architecte — et près de deux cents alertes surveillées.
des alertes qui atteignent des humains ; des tableaux de bord par audience
observabilitéGrafanaPrometheusmonitoringbusiness intelligenceTraqué les pannes les plus frustrantes pour les clients jusqu'à leur cause — à travers toutes les couches du système, du moteur à l'interface — et rendu l'attente prévisible : chaque requête affiche désormais une estimation fiable de sa durée.
des symptômes intermittents résolus à la racine, pas contournés
fiabilitéSREdiagnostic cross-stackexpérience clientConduit l'ingénierie du produit d'IA — poser sa question en langage naturel, obtenir la réponse analytique — avec la sécurité par construction (l'IA ne peut que lire, jamais modifier), un comportement mesuré par une batterie d'évaluations plutôt que deviné, et chaque centime de dépense IA attribué.
un produit d'IA gouverné : sûr par construction, mesuré, au coût maîtrisé
LLMagents IAsécurité IAévaluationTypeScriptgouvernance IAPréparé la migration du composant le plus central du système — le bus par lequel passe chaque événement client — conçue pour que la perte soit impossible par construction (à chaque instant, un événement n'existe que d'un seul côté, jamais de pont entre l'ancien et le nouveau), et répétée huit fois sur banc avant d'être jouée : les répétitions ratées publiées au même endroit que les réussies, deux défauts silencieux débusqués là plutôt qu'en production.
zéro perte mesurée sur chaque répétition réussie — l'événement compté un à un, pas estimé
Kafkamigration sans perterépétition généralegestion du risqueconception par constructionRéduit la facture cloud mensuelle d'environ un cinquième en trois mois, à périmètre de service constant — les leviers activés un par un, chaque économie vérifiée sur la facture du mois suivant.
≈ −20 % sur la facture cloud en ~3 mois, vérifié facture par facture — chiffres précis sur demande
FinOpsréduction de coûtsTCOvérification sur factureObtenu l'essentiel de l'économie par quatre leviers ordinaires, appliqués méthodiquement : mise à l'échelle automatique là où la charge varie, redimensionnement des machines surdimensionnées ou laissées inactives, politiques de rétention sur des données conservées sans raison, et montée de version des composants dont les générations récentes coûtent moins à service égal.
quatre leviers nommés, activés un par un — chacun vérifié sur la facture du mois suivant
FinOpsautoscalingdimensionnementpolitiques de rétentionmontée de versionréduction de coûtsAdopté l'IA pour reprendre et moderniser un produit legacy sans mainteneur d'origine : un DevOps assisté par agents, avec Claude (Anthropic) comme agent principal — le moteur de requêtes Spark migré, la migration du bus Kafka préparée et répétée, Kubernetes stabilisé, des composants migrés vers Kubernetes, un produit chatbot expérimenté.
Spark migré · Kafka préparé (8 répétitions) · Kubernetes stabilisé · composants migrés vers Kubernetes · un chatbot en production expérimentale
SparkKafkaKubernetesingénierie augmentée par IAagents IAClaudeAnthropiclegacymodernisationmigration
Humain & managérial
Le vrai gain ne tient pas au solo : le client et son équipe ont retrouvé la visibilité et la compréhension de leur propre système — tableaux de bord par type de lecteur, décisions toutes documentées et lisibles, revue mensuelle — là où la connaissance ne vivait plus que dans le code et dans des têtes parties depuis longtemps.
un système à nouveau observable et compréhensible par son propriétaire — pas seulement réparé
transmissionobservabilitévulgarisationautonomie du clientdocumentationRendre l'ingénierie lisible pour des décideurs non techniques : 34 restitutions écrites et présentées (dont une revue mensuelle de direction récurrente), conçues pour être comprises sans narrateur — chaque graphique interprété, chaque chiffre accompagné de sa conséquence.
un rythme de restitution régulier vers la direction, en anglais, à l'écrit comme à l'oral
communication écritevulgarisationgestion de parties prenantesanglais
Approche
Commencé par la preuve plutôt que par la promesse : quelques semaines d'audit de l'infrastructure, restituées en 18 investigations écrites — c'est ce travail qui a décidé le client à signer un contrat de six mois, structuré en jalons aux critères de succès mesurables.
un audit initial converti en contrat de six mois
auditcadrage de missionconfiance par la preuveAvant l'opération la plus délicate de la mission, écrire deux documents pour deux publics : un brief pour l'équipe communication (que dire aux clients, et quand), et un guide de nuit « que quelqu'un qui n'a jamais touché le système peut suivre » — parce que la compétence utile à trois heures du matin n'est pas de savoir taper, c'est de distinguer « attendu » de « on s'arrête ».
le savoir-faire critique rendu transmissible avant l'opération, pas après — « ne pas prendre l'entreprise en otage »
gestion du bus factorcommunication de crisevulgarisationrunbooksanticipationAnnoncé honnêtement les limites du périmètre — une migration majeure était déclarée « hors de portée d'une seule personne, il faudrait un spécialiste » dans ma proposition — puis, l'outillage par agents IA ayant fait ses preuves, livrée moi-même, au-delà du cadre annoncé.
un hors-périmètre déclaré, livré quand même — prudence à l'annonce, dépassement à l'exécution
honnêteté de cadrageingénierie augmentée par IAgestion des attentesUn principe assumé jusque dans le contrat : je travaille seul, augmenté par des agents IA (Claude, d'Anthropic) — et l'accélération bénéficie au client, à prix de jalon fixe. Quatre règles gouvernent chaque jalon : aucune modification manuelle non auditable, mesurer avant/après (« un jalon qui ne se mesure pas ne se signe pas »), l'outillage IA annoncé honnêtement, et chaque décision consignée par écrit.
cadence d'équipe à effectif d'une personne — méthode contractualisée
ingénierie augmentée par IAagents IAClaudetransparencemeasurement-firstInfrastructure as CodeLivrer sans casser un système que personne ne connaît plus : chaque changement arrive éteint, tourne en parallèle de l'existant pour comparer les résultats — au bit près quand il le faut — puis s'active progressivement, client par client.
prudence systématique : comparer d'abord, activer ensuite, généraliser enfin
déploiement progressiffeature flagsprudencegestion du risque
Vue composée depuis une base de faits vérifiés — un même socle, relu selon l'angle du lecteur.