Ingénieur systèmes distribués · Leadership technique

Je transforme les problèmes de production ambigus en
systèmes fiables, efficaces et simples à exploiter.

Ingénieur en systèmes distribués, spécialisé dans la fiabilité et l’exploitabilité — des environnements d’exécution embarqués et du stockage distribué aux pipelines de traitement temps réel à haut débit et aux plans de contrôle. J’interviens avec plusieurs équipes sur la conception de systèmes, les migrations en production et l’outillage nécessaire à leur exploitation sûre.

Me contacter Télécharger le CV

Définir le comportement, concevoir pour la défaillance, valider le changement et rendre le système plus facile à exploiter

01

J’explicite la décision : la contrainte de production, le comportement attendu, les compromis techniques, les dépendances et responsabilités inter-équipes, et les éléments qui valideront l’approche.

02

Je porte le changement jusqu’aux tests de bout en bout, à la validation sur trafic réel lorsque c’est pertinent, au déploiement progressif, aux procédures de reprise testées et à la passation opérationnelle.

03

Je transforme le travail opérationnel récurrent nécessitant une intervention experte en outillage et en workflows de libre-service automatisés et validés, afin que d’autres ingénieurs puissent exploiter et faire évoluer le système de manière autonome.

Là où cette approche est la plus utile

J’aide les équipes à rendre les systèmes de production à haut débit plus fiables, plus faciles à diagnostiquer et à exploiter — des pipelines de traitement, du routage et des plans de contrôle au stockage distribué.


Réalisations sélectionnées

Cohérence inter-domaines de l’évaluation des moniteurs en dégradation partielle

Intégré des signaux de fraîcheur et d’exhaustivité des données dans l’évaluation des moniteurs entre Alerting et Metrics, afin que des données de plateforme retardées ou incomplètes ne soient pas interprétées comme un comportement client ; le cadre a favorisé une reprise plus sûre en mode dégradé et a été étendu à d’autres domaines produit.

Traitement temps réel à haut débit avec ~3× moins de ressources

Pris en charge et optimisé des systèmes de routage et de traitement gérant des milliards d’événements par seconde sur des données à l’échelle du pétaoctet et des milliers de workers, réduisant l’utilisation des ressources d’environ 3× grâce au cache, au sharding et à l’optimisation des chemins critiques, tout en validant la correction et le comportement en cas de défaillance dans des conditions de production.

Stockage et synchronisation distribués

Stabilisé les mécanismes internes d’un système de fichiers distribué et de synchronisation sensibles à la correction, puis industrialisé son exploitation sous Linux afin que les utilisateurs puissent diagnostiquer et rétablir le comportement de l’environnement d’exécution.

Fiabilité des plateformes embarquées

Pris en charge le firmware, le noyau, le démarrage et la reprise pour rendre les plateformes sans fil embarquées plus sûres à mettre à jour, diagnostiquer et exploiter à distance.


Parcours professionnel

Déc. 2017 - Présent

Datadog · Paris, France

Ingénieur logiciel en systèmes distribués

Conçu et exploité des plans de contrôle de routage et des systèmes de traitement à haut débit pour les produits Alerting et Metrics de Datadog. Collaboré avec les équipes Produit et plateforme sur le comportement des moniteurs, les diagnostics de télémétrie et les migrations en production.

  • Rédigé la conception et piloté l’évolution d’un plan de contrôle de routage et de migration permettant des workflows en libre-service, dont l’exécution et le diagnostic assistés par IA. Sécurisé les migrations en production par des déploiements progressifs, une validation sur trafic réel et des procédures de reprise simples.
  • Défini la sémantique des moniteurs côté client et les workflows de diagnostic de télémétrie pour les opérateurs avec le Produit, la direction de l’ingénierie et les équipes plateforme. Préservé la compatibilité des workflows de moniteurs établis tout en clarifiant le comportement d’évaluation recommandé. Réorienté une proposition d’investigation de télémétrie à forte cardinalité d’un pipeline autonome coûteux vers un workflow d’investigation à périmètre limité, puis piloté sa conception et sa mise en production.
  • Piloté l’intégration des signaux de fraîcheur et de complétude des données dans les systèmes de traitement et d’interrogation Metrics ainsi que dans le pipeline d’évaluation Alerting, réduisant les faux positifs et faux négatifs lors de dégradations partielles et rendant la reprise en mode dégradé plus prévisible.
  • Amélioré les pipelines de traitement des service checks et des métriques temps réel, traitant des milliards d’événements par seconde, des jeux de données à l’échelle du pétaoctet et s’exécutant sur des milliers de pods de workers. Réduit l’utilisation des ressources d’environ un facteur 3 grâce au cache, au sharding et à l’optimisation des chemins critiques.
  • Développé un outillage de migration réutilisable, des diagnostics assistés par IA et une validation de bout en bout pour la couche de stockage temps réel. Des ingénieurs externes à l’équipe d’origine ont utilisé ce workflow pour mener migrations et nettoyages sans support direct.
Avr. 2015 - Déc. 2017

Lima · Paris, France

Ingénieur logiciel cœur de produit

Développé les composants centraux d’un système de fichiers distribué, d’un sous-système de synchronisation et de l’outillage de fabrication.

  • Amélioré la robustesse de la réplication, les performances des transactions et l’efficacité du ramasse-miettes afin de permettre au système de fichiers distribué de gérer de très grandes arborescences comptant des centaines de milliers de fichiers et de répertoires.
  • Conçu le processus de test et de provisionnement en usine, développé les logiciels de test matériel, de flashage de firmware et d’identification des appareils, puis installé le système sur site.
  • Conçu et implémenté le partage de fichiers via des passerelles web publiques.
Déc. 2008 - Avr. 2015

Sequans Communications · Paris, France

Ingénieur logiciel embarqué

Développé des firmwares LTE et des logiciels de plateformes embarquées, notamment des noyaux Linux et temps réel, le démarrage et la récupération, des pilotes de périphériques et l’infrastructure de build.

  • Implémenté JFFS2 en mode lecture/écriture pour vxWorks afin de faciliter la transition du noyau vxWorks vers eCos.
  • Optimisé les couches USB, réseau et interprocesseur, rapprochant le débit des limites matérielles.
  • Renforcé la résilience du démarrage, de la récupération et des mises à jour de firmware. Développé des outils de diagnostic post-crash et de builds de firmware reproductibles sur plusieurs dépôts.

Expertise

Traitement de flux à haut débit Plans de contrôle et routage fiables Stockage et synchronisation distribués Systèmes embarqués, noyaux et pilotes Fiabilité et performance en production

Travaillons ensemble

Dmytro Milinevskyi

Ingénieur systèmes distribués · Leadership technique · Paris, France ou à distance

Téléphone

+33 (0)6 08 23 66 58