0% ont trouvé ce document utile (0 vote)
5 vues2 pages

Formation Apache Flink : Big Data en Java

Ce document présente un cours pratique de trois jours sur Apache Flink, destiné aux développeurs et architectes ayant de bonnes connaissances en Java. Les participants apprendront à développer des applications de big data en utilisant les API DataSet, DataStream et Table, ainsi qu'à déployer Flink sur des environnements cloud. La formation inclut des travaux pratiques, des évaluations et est animée par des formateurs expérimentés dans le domaine.

Transféré par

drivesankofa
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
5 vues2 pages

Formation Apache Flink : Big Data en Java

Ce document présente un cours pratique de trois jours sur Apache Flink, destiné aux développeurs et architectes ayant de bonnes connaissances en Java. Les participants apprendront à développer des applications de big data en utilisant les API DataSet, DataStream et Table, ainsi qu'à déployer Flink sur des environnements cloud. La formation inclut des travaux pratiques, des évaluations et est animée par des formateurs expérimentés dans le domaine.

Transféré par

drivesankofa
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Flink, développer des applications pour le Big PARTICIPANTS

Développeurs, architectes.

Data PRÉREQUIS
Bonnes connaissances du langage
Java.
Cours Pratique de 3 jours - 21h
Réf : FKB - Prix 2025 : 2 330 HT COMPÉTENCES DU
FORMATEUR
Les experts qui animent la
formation sont des spécialistes des
matières abordées. Ils ont été
validés par nos équipes
Apache Flink est un framework big data récent. Il simplifie les traitements de flux gros pédagogiques tant sur le plan des
connaissances métiers que sur
débit temps réels comme les traitements batch sur d'énormes quantités de données (sur celui de la pédagogie, et ce pour
Hadoop HDFS, sur Amazon S3, sur MongoDB...). Ce cours vous permet d'installer Flink chaque cours qu’ils enseignent. Ils
et de réaliser, en Java, des traitements variés de big data. ont au minimum cinq à dix années
d’expérience dans leur domaine et
occupent ou ont occupé des postes
à responsabilité en entreprise.
OBJECTIFS PÉDAGOGIQUES TRAVAUX PRATIQUES MODALITÉS D’ÉVALUATION
À l’issue de la formation l'apprenant sera en mesure de : Mise en pratique des notions vues en Le formateur évalue la progression
cours à l'aide du langage Java. pédagogique du participant tout au
Maîtriser les concepts fondamentaux de Flink long de la formation au moyen de
QCM, mises en situation, travaux
Développer des applications à l'aide de DataSet pratiques…
Le participant complète également
et DataStream API un test de positionnement en amont
et en aval pour valider les
Traitement de données distribué avec Flink et compétences acquises.
Hadoop
MOYENS PÉDAGOGIQUES
Exploiter des données avec Table API ET TECHNIQUES
• Les moyens pédagogiques et les
Avoir une première approche du machine méthodes d’enseignement utilisés
sont principalement : aides
learning audiovisuelles, documentation et
support de cours, exercices
pratiques d’application et corrigés
des exercices pour les stages
pratiques, études de cas ou

LE PROGRAMME présentation de cas réels pour les


séminaires de formation.
• À l’issue de chaque stage ou
dernière mise à jour : 07/2024 séminaire, ORSYS fournit aux
participants un questionnaire
d’évaluation du cours qui est
ensuite analysé par nos équipes
pédagogiques.
1) Introduction à Apache Flink • Une feuille d’émargement par
- Historique du framework. demi-journée de présence est
fournie en fin de formation ainsi
- Les différentes versions de Flink. qu’une attestation de fin de
formation si le stagiaire a bien
- Comparaison avec l'environnement Apache Hadoop et Apache Spark. assisté à la totalité de la session.
- Les différents modules de Flink.
MODALITÉS ET DÉLAIS
Travaux pratiques : Installation et configuration de Flink. Exécution d'un premier exemple D’ACCÈS
avec le comptage de mots. L’inscription doit être finalisée 24
heures avant le début de la
formation.
2) Traitement de données à l'aide de l'API DataStream
ACCESSIBILITÉ AUX
- Environnement d'exécution et sources de données. PERSONNES HANDICAPÉES
- Les transformations : Map, FlatMap, Filter, KeyBy, Reduce... Vous avez un besoin spécifique
d’accessibilité ? Contactez Mme
- Les opérations sur des flux multiples : Union, Cogroup, Connect, Join, Iterate... FOSSE, référente handicap, à
l’adresse suivante psh-
- Les opérations sur Windows : Global, Tumbling, Sliding, Session... accueil@[Link] pour étudier au
- Le partitionnement physique personnalisé, aléatoire, rééquilibrage et mieux votre demande et sa
faisabilité.
redimensionnement.
- Les DataSink et les connecteurs : Kafka, X (anciennement Twitter), ElasticSerch...
Travaux pratiques : Consommation et manipulation de différents flux des données.

3) Traitement de données à l'aide de l'API Batch


- Les différents types de sources de données.
- Les transformations et agrégations.
- L'écriture des données.
- Les DataSink et les connecteurs : HDFS, S3, Avro, MongoDB.
Travaux pratiques : Manipulation de DataSets à partir de plusieurs sources de données.

ORSYS - [Link] - info@[Link] - +33 (0)1 49 07 73 73 Page 1 / 2


4) Traitement de données à l'aide de l'API Table
- Enregistrement et lecture des tables enregistrées.
- Les opérateurs : sélection, filtre, jointure, orderBy...
- Utiliser du SQL sur le flux de données.
- Traitement des événements complexes.
Travaux pratiques : Mise en place d'une analyse avec SQL sur un flux de données.

5) API Flink Graph - Gelly


- Qu'est-ce qu'un graphe ?
- Les différentes opérations.
- Créer des graphes.
- Transformations de graphes.
- Présentation de différents algorithmes.
Travaux pratiques : Manipulation de l'API travers différents exemples.

6) Déploiement de Flink
- Flink sur YARN Configurations.
- Lancement et arrêt d'un cluster.
- Soumettre un travail à Flink.
- Flink sur Google Cloud.
- Flink sur AWS.
Travaux pratiques : Configurer un cluster multinœuds et déployer une application.

LES DATES

CLASSE À DISTANCE
2025 : 10 déc.

ORSYS - [Link] - info@[Link] - +33 (0)1 49 07 73 73 Page 2 / 2

Vous aimerez peut-être aussi