Concevoir et déployer des architectures Big Data scalables, sécurisées et performantes pour collecter, traiter et valoriser de grands volumes de données en temps réel ou batch.
Programme de la formation
1. Fondamentaux Big Data & écosystème Hadoop
2. Traitement distribué avec Spark (batch & SQL)
3. Ingestion & streaming temps réel (Kafka, Spark Streaming)
4. Bases NoSQL, Data Lake & Lakehouse
5. Sécurité, gouvernance & gestion des métadonnées
6. Optimisation des performances & conception d’architecture
public cible
Architectes systèmes, Data Engineers, administrateurs bases de données, développeurs expérimentés, chefs de projet technique.