PoC Hadoop
Validé
Démonstrateur isolé de traitement Big Data, exécuté avec succès sur un cluster réel à partir de journaux de sécurité anonymisés, avec un résultat vérifié par recoupement avec un calcul local. La démonstration de compétence n'a pas conduit à intégrer Hadoop à l'architecture de production, un choix assumé au nom de la sobriété numérique.
Les journaux de sécurité utilisés ont été anonymisés avant tout chargement : horodatage tronqué au jour, identifiants directs ou quasi-directs supprimés, texte libre retiré — aucun journal brut n'a été chargé sur le cluster.
Le job de traitement distribué (agrégation d'événements par jour et par catégorie) a produit un résultat strictement identique à une simulation réalisée localement sans aucune infrastructure, ce qui constitue une validation croisée du traitement distribué.
Deux incidents opérationnels réels ont été rencontrés et corrigés en cours de route, puis documentés par transparence méthodologique : un dimensionnement des ressources insuffisant a bloqué le job avant correction, et l'image du cluster utilisée a nécessité une adaptation de compatibilité. Ces incidents illustrent concrètement le coût opérationnel réel d'un tel traitement, même réduit à l'essentiel, pour un volume de données qui aurait pu être traité en une seule requête sur la base PostgreSQL déjà en place.