Data - Intermédiaire

Apache Kafka : streaming de données

À l’issue de la formation, le stagiaire sera capable de gérer des flux de données en temps réel.

Programme

  • Introduire les fondamentaux de la formation et la mise en place de la veille technologique
  • Réaliser le travail de veille #1 sur les registres de schémas dynamiques
  • Réaliser le travail de veille #2 sur la clusterisation auto-gérée sur Kubernetes
  • Déployer une infrastructure de messagerie distribuée
  • Configurer la topologie des flux de données
  • Développer des agents producteurs/consommateurs résilients
  • Implémenter la gouvernance des garanties de livraison
  • Maîtriser l'architecture de stockage distribué
  • Configurer les topologies de partitionnement logique
  • Mettre en place les mécanismes de réplication synchrone
  • Coordonner les nœuds de grappe
  • Implémenter les sémantiques de livraison transactionnelle
  • Équilibrer la charge applicatif
  • Configurer la sérialisation et la validation de schémas
  • Gérer la persistance et l'acquittement des flux
  • Assurer la supervision et le traitement des pannes
  • Maintenir la continuité de service des flux en production
  • Implémenter l'observabilité et les métriques de latence
  • Configurer les politiques de rétention et d'épuration
  • Router les flux anomalies vers les Dead Letter Queues
  • Réguler les débits asynchrones
  • Formaliser et analyser les apprentissages réalisés
  • Objectifs pédagogiques

    - Déployer et configurer Kafka.

    - Produire et consommer des messages.

    - Gérer les topics, partitions et réplicas.

    - Assurer la fiabilité et la résilience des flux.

    Durée et format

    3 jours

    Formation synchrone en téléprésentiel

    Tarifs

    Tarif inter-entreprises : 2 160 € / participant

    Tarif intra-entreprise : sur demande

    Publics

    Développeurs, data engineers.

    Pré-requis

    Notions de messagerie.

    Modalités pédagogiques

    Vous avez 1 jour pour réaliser ce travail de développement d'agents et de sécurisation des échanges. Vous réaliserez ce travail en binôme. L'entraide entre les différents groupes est bienvenue.

    Modalités et critères d'évaluation

    Modalités d'évaluation

    • votre responsable technique (formateur) validera en binôme le bon fonctionnement de votre logique de production/consommation et la résistance aux coupures réseau.
    • votre responsable technique animera une review collective du code à partir d'un des livrables du groupe, tiré au hasard.

    Critères d'évaluation

    • La livraison est garantie : les tests d'injection de données prouvent une absence totale de perte et de doublons dans le système récepteur (cohérence stricte validée).
    • La parallélisation est effective : les messages sont distribués et consommés de façon équilibrée sur l'ensemble des partitions logiques disponibles.
    • La reprise après panne est robuste : en simulant l'arrêt brutal d'un agent de lecture au milieu d'un flux, le système reprend son traitement exactement là où il s'était arrêté, sans omettre aucun message.

    Livrables

    • le code source applicatif (.py, .java ou .go) contenant la logique d'initialisation des producteurs sécurisés et des consommateurs synchrones
    • le fichier de configuration des propriétés techniques contenant les paramètres d'acquittement, d'identifiants de transaction et de politiques de reconnexion
    • une capture d'écran des journaux d'exécution démontrant la réassignation automatique de la charge de lecture lors de la déconnexion provoquée d'un des consommateurs

    Handicap

    Si vous êtes en situation de handicap, il est possible de mettre en place des aménagements.

    Sessions

    Prochaine session le 25 Novembre 2026.

    Cette formation vous intéresse ?
    Contactez-nous pour échanger sur votre projet de formation.