Audit d’infrastructure data, due diligence technique et dimensionnement
Une revue indépendante de la performance, de la scalabilité, de la fiabilité, de la résilience et des coûts, sur toutes les couches de votre plateforme data et IA.
J’interviens pour des CTO, DSI, responsables plateforme et data, et des investisseurs qui ont besoin d’une réponse technique actionnable : avant une montée en charge, avant une migration, avant un achat matériel ou un engagement fournisseur, avant une opération capitalistique, ou quand une plateforme en production ne se comporte plus de façon prévisible. La revue couvre toutes les couches, du code applicatif jusqu’aux disques, et débouche sur des décisions classées par priorité plutôt que sur une liste d’observations.
Ce qui déclenche une revue
Avant un engagement
- Vous investissez dans une société, vous l’acquérez ou vous entrez à son capital, et sa valeur dépend d’une plateforme technique.
- Vous êtes sur le point de vous engager sur un produit data, IA ou infrastructure stratégique et vous voulez confronter les promesses aux preuves.
- Vous devez dimensionner une nouvelle plateforme et choisir serveurs, instances ou stockage avant de signer le budget.
- Une migration, un re-plateforming ou une refonte d’architecture démarre, et les hypothèses n’ont jamais été challengées de l’extérieur.
- Un fournisseur a proposé une configuration et personne en interne ne peut vérifier si elle est juste, généreuse ou sous-dimensionnée.
Sous contrainte de charge
- Le trafic, le volume de données ou la demande d’entraînement de modèles va augmenter d’un facteur important et vous devez savoir ce qui cède en premier.
- Les coûts d’infrastructure augmentent plus vite que l’usage et les causes sont réparties entre plusieurs équipes.
- Votre plan de reprise d’activité n’a jamais été testé en conditions réalistes, et les RTO / RPO annoncés doivent survivre à une bascule réelle.
Quand la plateforme devient la contrainte
- Vos jobs Spark sont lents, instables ou coûteux.
- Vos pipelines Kafka sont difficiles à opérer à grande échelle.
- Ceph, MinIO, Cassandra ou la couche de stockage produisent une latence ou une fiabilité imprévisibles.
- La plateforme data freine vos initiatives IA ou analytics.
Ma méthode : toutes les couches, une seule revue
Je ne limite pas une revue à un seul produit, une seule couche logicielle ou une seule équipe. Selon la question posée, l’investigation traverse :
- le code source applicatif, les algorithmes et les modèles de données ;
- les moteurs de traitement distribué, les bases de données et les systèmes de messagerie ;
- Kubernetes, l’orchestration de conteneurs et l’ordonnancement ;
- le réseau et les chemins de données ;
- le stockage objet, bloc et distribué ;
- la configuration du système d’exploitation et de l’infrastructure ;
- l’architecture des serveurs, les spécifications des disques et leur comportement mesuré ;
- le plan de capacité et la proposition fournisseur qui accompagne l’achat.
Je peux passer, dans une même mission, de la lecture du code source d’un job Spark à la remise en cause des spécifications de disques dans un devis fournisseur. Cette amplitude est le cœur de la valeur. Les revues qui s’arrêtent à la frontière d’une couche produisent des diagnostics incomplets, des optimisations qui déplacent le goulot d’étranglement ailleurs, du surdimensionnement acheté comme une assurance, des refontes qui n’étaient pas nécessaires, un dimensionnement dicté par celui qui vend le matériel, et des mois d’essais et d’erreurs pendant que cinq équipes défendent cinq hypothèses plausibles.
Mes offres
Audit data platform : à partir de 7 500 € HT
Fourchette typique : 7 500 € à 15 000 € HT selon le périmètre, l’urgence et la complexité du système.
Une revue complète d’une plateforme data, cloud ou IA complexe dont la performance, la scalabilité, la fiabilité ou le coût ont un impact business. C’est la mission adaptée aux problèmes transverses, aux plateformes qui vont franchir un palier de charge important, et aux décisions qui demandent plus d’éléments qu’une revue de composant isolé.
Livrables types : cartographie d’architecture ; analyse des goulots d’étranglement ; risques de fiabilité et de scalabilité ; modèle de coûts et de capacité ; quick wins ; roadmap priorisée ; restitution exécutive pour CTO, VP Engineering ou Head of Platform.
Due diligence technique : à partir de 4 500 € HT
Une lecture technique indépendante pour investisseurs, acquéreurs et comités de direction, avant d’investir dans une société, d’acquérir des parts, de valider une plateforme fournisseur ou de s’engager sur un produit d’infrastructure data ou IA stratégique.
Périmètre type : revue d’architecture et de code source quand il est accessible ; évaluation des risques de scalabilité, de fiabilité et d’infrastructure ; dette technique et maturité opérationnelle ; trajectoire de coûts induite par l’architecture actuelle à l’échelle visée ; confrontation des affirmations du fournisseur ou de la cible aux preuves disponibles ; note de risque écrite avec les éléments de décision et les questions de suivi priorisées.
Idéal pour : les investisseurs qui ont besoin d’une diligence technique avant une opération, les dirigeants qui évaluent une acquisition dont la valeur repose sur une plateforme, et les équipes qui s’engagent sur un produit où la performance, la dépendance fournisseur, la fiabilité ou le coût changeraient sensiblement le business case.
Dimensionnement et plan de capacité : à partir de 4 500 € HT
Un dimensionnement fondé sur des mesures, pour un nouveau déploiement, une montée en charge, une migration ou une décision de re-plateforming.
C’est l’un de mes domaines les plus solides. Je dimensionne les composants open source (Kafka, Cassandra, ScyllaDB, Ceph, MinIO, PostgreSQL, Kubernetes, Spark, Pulsar) face à la charge réelle, puis je traduis le résultat en matériel concret : les bons types d’instances dans un catalogue cloud public, ou la bonne configuration de serveurs et de disques dans un catalogue constructeur type Dell ou HPE. Quand un fournisseur a déjà proposé une configuration, je la confronte à ce dont les composants ont réellement besoin et à ce que le matériel délivre réellement.
Périmètre type : analyse de la charge cible ; dimensionnement compute, stockage et réseau ; sélection de serveurs et d’instances dans les catalogues cloud ou constructeurs ; recommandations de marge de capacité ; estimation de coût selon l’infrastructure retenue, on-premise, cloud privé ou cloud public ; document de dimensionnement écrit et restitution.
Revue d’architecture flash : à partir de 4 500 € HT
Une décision critique, un goulot d’étranglement ou un composant système, examiné en profondeur et tranché rapidement.
Périmètre type : revue d’architecture ; entretiens techniques ; revue de métriques, logs et configurations quand elles sont disponibles ; diagnostic écrit ; recommandations priorisées ; restitution avec le CTO, le tech lead ou l’équipe plateforme.
Évaluation résilience et plan de reprise : à partir de 4 500 € HT
Une validation technique de la capacité réelle de votre plateforme à survivre aux pannes qu’elle est censée absorber, et à redémarrer dans la fenêtre promise au métier.
Périmètre type : analyse des scénarios de panne et de leur périmètre d’impact ; revue de la conception haute disponibilité et tolérance aux pannes ; topologie de réplication, cohérence et retard de réplication en cas de partition ; intégrité des sauvegardes et débit de restauration mesuré face aux volumes réels ; ordre des dépendances pendant la reprise ; pratique des tests de restauration ; verdict d’atteignabilité sur les RTO et RPO annoncés, avec l’analyse d’écart correspondante.
Avant implémentation, cela permet d’identifier les choix de conception qui rendent la cible inatteignable. Après implémentation, cela vérifie que le document décrit bien le système qui tourne. Les plans de reprise échouent sur des détails qui n’apparaissent qu’au test : une réplication silencieusement en retard, un chemin de restauration limité par le débit, une procédure qui suppose disponible un plan de contrôle lui-même touché par la panne.
Revue d’optimisation des coûts : à partir de 4 500 € HT
Une revue technique de ce que coûte votre plateforme et pourquoi, reliée aux choix d’ingénierie qui produisent la facture.
Dans une plateforme data, le coût n’appartient presque jamais à une seule équipe. Le dimensionnement des exécuteurs, les quotas Kubernetes, l’organisation du stockage et le facteur de réplication, la politique de rétention, l’allocation GPU, la capacité inutilisée, les transferts de données et la tarification fournisseur y contribuent tous. Je passe en revue chaque poste avec les preuves techniques correspondantes, pour que vous puissiez distinguer le gaspillage de la marge que vous avez raison de conserver.
Périmètre type : répartition des coûts par charge de travail ; opportunités de redimensionnement avec les mesures qui les justifient ; économie du stockage, de la réplication et de la rétention ; analyse de l’ordonnancement et du taux d’utilisation ; revue des engagements et de la tarification fournisseur ; liste de réductions classées avec effort et risque associés.
Appel expert : 250 € HT / 1h
Une session vidéo focalisée sur une question d’architecture, de performance, de scalabilité, de résilience ou de coût. Idéal pour valider une orientation, challenger une proposition ou obtenir un avis externe avant une décision plus large. C’est un produit autonome, pas une étape à acheter avant un audit.
Senior Advisor récurrent : à partir de 3 000 € HT / mois
Une revue senior récurrente pour les équipes qui opèrent une infrastructure data complexe. Quelques heures par mois de challenge d’architecture indépendant, d’analyse d’incidents et d’appui sur la roadmap, sans recruter un principal engineer à temps plein. L’appel de découverte pour cette offre est gratuit.
Pour qui c’est fait, pour qui ce n’est pas fait
C’est pour : investisseurs, acquéreurs, CTO, DSI, responsables plateforme et data, VP Engineering et responsables SRE qui évaluent, dimensionnent, font monter en charge ou opèrent une infrastructure data, cloud ou IA en production, quand la performance, la fiabilité, la résilience, la dette technique ou le coût ont un impact business mesurable.
Ce n’est pas pour : le renfort de capacité (staff augmentation), le freelance individuel longue durée, la stratégie cloud générique, ou les missions d’un périmètre inférieur à 5 000 €. Si la question tient en une heure, l’Appel expert est le bon point d’entrée et je vous le dirai dès l’appel de cadrage.
Sélection de missions clients
Liste non exhaustive d’engagements passés. Je nomme certains clients avec leur accord ; j’anonymise les autres.
- BPCE-IT : Performance et fiabilité Cassandra pour une plateforme d’API Management. « Son expertise et ses compétences ont contribué à améliorer la performance et le comportement de nos plateformes. »
- Data lake privé multi-pétaoctets : audit indépendant d’un grand data lake on-premise supportant des charges analytics et IA
- MinIO et Ceph à grande échelle : performance et observabilité sur stockage objet en production
- Spark sur Kubernetes : performance et fiabilité sur plateformes Spark en cloud privé
- Pipelines géospatiaux / imagerie satellite : design d’infrastructure pour traitement d’images haut volume
Références disponibles sur demande sous NDA.
Pourquoi moi
J’ai un PhD en optimisation numérique et calcul haute performance, et plus de 20 ans d’expérience hands-on en production sur des systèmes distribués, des plateformes data et du cloud privé.
J’ai travaillé sur des data lakes multi-pétaoctets, Spark sur Kubernetes, du stockage objet Ceph et MinIO, Cassandra et ScyllaDB, des pipelines d’imagerie satellite, de l’infrastructure bancaire, des plateformes télécom et des systèmes aérospatiaux.
Je ne vends ni implémentation, ni licences, ni matériel, et je travaille seul. Vous obtenez un avis senior unique, assumé et sans détour, dont aucune conclusion ne dépend de ce que vous achèterez ensuite.
Comment ça se passe
- Cadrage : Clarifier la question, les frontières du système, l’échéance et l’impact business attendu.
- Investigation : Revue de l’architecture, du code, des métriques, des configurations, des plans de capacité, des incidents, des hypothèses de l’équipe et des contraintes.
- Priorisation : Classer les contraintes, les risques, les quick wins et les corrections à fort retour.
- Restitution : Diagnostic écrit et roadmap technique priorisée, puis présentation à votre équipe.
FAQ
Avez-vous besoin d’un accès production ?
Généralement non. Les métriques, schémas d’architecture, extraits de configuration et entretiens techniques suffisent souvent à démarrer.
Cela peut-il se faire à distance ?
Oui. La plupart des missions sont remote-first.
Travaillez-vous avec des clients hors de France ?
Oui. Les missions sont remote-first et se déroulent en français ou en anglais. Je travaille avec des clients en Europe et en Amérique du Nord, et je cale les entretiens et les restitutions sur le fuseau horaire du client.
Pouvez-vous auditer une proposition fournisseur ou un plan de capacité ?
Oui, c’est une demande fréquente. Je confronte la configuration proposée à la charge qu’elle doit absorber et à ce que le matériel délivre réellement, et je vous dis où elle est sous-dimensionnée, où elle est généreuse, et quelles preuves manquent.
Est-ce uniquement pour les grandes entreprises ?
Non, mais la décision ou le problème doit être suffisamment important pour justifier une mission premium.
Pouvez-vous aider à implémenter les recommandations ?
Oui, mais la revue est conçue pour être autonome. L’implémentation peut être cadrée séparément.
Pourquoi pas simplement embaucher un freelance pour quelques mois ?
Parce que vous n’avez peut-être pas besoin de plus de bras. Vous avez peut-être besoin d’un diagnostic indépendant avant de partir pendant des mois dans la mauvaise direction.
Demander une revue indépendante
Un appel gratuit de 15 min pour parler de la plateforme, de la décision ou de l’opération en cours, et déterminer l’offre adaptée : due diligence technique, audit, dimensionnement, revue flash, évaluation de résilience ou appel expert.