Présentation
La source Kafka streame des données depuis un topic Apache Kafka dans Reelevant. Utilisez-la pour l’ingestion de données en temps réel ou quasi temps réel depuis des architectures événementielles, des plateformes de streaming ou des courtiers de messages qui exposent une interface compatible Kafka.Configuration
Champs obligatoires
Authentification
- Sans authentification
- SASL
Pour les clusters Kafka sans authentification (environnements de développement), aucun champ supplémentaire n’est nécessaire.
Champs optionnels
Schema Registry
Si vos messages Kafka utilisent la sérialisation Avro avec un Confluent Schema Registry, configurez l’objetregistry :
Lorsque cette option est configurée, les messages sont automatiquement désérialisés en utilisant le schéma du registry.
Formats de messages pris en charge
Comportement du consumer
Mode Worker (par lots)
Lorsqu’elle est utilisée avec une Datasource en mode worker (synchronisation périodique par lots), la source Kafka :- Se connecte au topic et lit tous les messages disponibles jusqu’au dernier offset courant.
- Se déconnecte une fois que tous les messages ont été consommés.
- Lors des synchronisations suivantes, la lecture reprend là où elle s’était arrêtée (les offsets du consumer group sont préservés).
Mode Ingester (continu)
Lorsqu’elle est utilisée avec une Datasource en mode ingester (streaming continu), la source Kafka :- Se connecte au topic et consomme en continu les nouveaux messages à mesure qu’ils arrivent.
- Les messages sont traités et stockés en temps réel.
Fonctionnement
- Reelevant se connecte au cluster Kafka avec les adresses de brokers fournies.
- Un consumer group est créé (ou repris) pour la Datasource.
- Les messages sont consommés depuis le topic configuré.
- Si un Schema Registry est configuré, les messages sont désérialisés en utilisant le schéma Avro.
- Les champs sont extraits et rendus disponibles pour le mapping.
La source Kafka prend en charge nativement les messages compressés en LZ4.