top of page
Image de NordWood Themes

Big Data, architecture & technologies

Public
Chefs de projets, architectes, et toute personne souhaitant connaître les outils et solutions pour mettre en place une architecture BigData.

Objectifs

Comprendre les concepts du BigData et connaître les technologies associées.

Programme
 

1. Introduction

  • Le besoin : volumes importants de données, traitements optimisés de flux de données au fil de l'eau (nouvelles technologies et nouveaux usages).

  • Domaines concernés : recherche scientifique, médical, e-commerce, sécurité, ...

  • Développement des techniques sur différents aspects : stockage, indexation/recherche, calcul

  • Définition de ETL : Extract Transform Load

  • Les acteurs aujourd'hui
     

2. Stockage

  • Caractéristiques NoSQL :

    • Structure de données proches des utilisateurs, développeurs

    • Données structurées et non structurées, documents, images,

  • Fichiers XML, JSON, CSV, ...

  • Les différents modes et formats de stockage

  • Stockage réparti : réplication, sharping, gossip protocl, hachage,

  • Systèmes de fichiers distribués : GFS, HDFS, BigTable, ...

  • Les bases de données

  • Quelques exemples de produits et leurs caractéristiques : cassandra, MongoDB, CouchDB, DynamoDB...
     

3. Indexation et recherche

  • Moteurs de recherche

  • Principe de fonctionnement

  • Méthodes d'indexation

  • Exemple de Lucene, et mise en oeuvre avec solr

  • Recherche dans les bases de volumes importants

  • Exemples de produits et comparaison : dremel, drill, elasticsearch, MapReduce...
     

4. Calcul et restitution, intégration

  • Différentes solutions : calculs en mode batch, ou en temps réel, sur des flux de données ou des données statiques.

  • Les produits : langage de calculs statistiques, R Statistics Language

  • Outils de calcul sur des volumes importants : storm en temps réel, hadoop en mode batch.

  • Zoom sur Hadoop : complémentarité de HDMS et MapReduce.
     

5. Evolutions

  • Les offres Saas BigData, type Google BigQuery.

  • Les limites actuelles. Les avancées annoncées.

 

 

 

Prérequis

bonne culture générale sur les systèmes d'information

Moyens pédagogiques

Réflexion de groupe et apports théoriques du formateur
Travail d'échange avec les participants sous forme de réunion-discussion
Utilisation de cas concrets issus de l'expérience professionnelle
Validation des acquis par des questionnaires, des tests d'évaluation, des mises en situation.
Remise d'un support de cours.

 

Moyens techniques en présentiel
L'accueil des stagiaires est fait dans une salle dédiée à la formation, équipée d'ordinateurs, d'un vidéo projecteur, d'un tableau blanc et d'un paperboard.

 

Moyens techniques des classes en distanciel
La formation est organisée a l'aide d'un logiciel comme Teams, Zoom etc... un micro et éventuellement une caméra pour l'apprenant. Vous suivez ainsi une formation en temps réel et entièrement à distance. Lors de la classe en ligne, les apprenants interagissent et communiquent entre eux et avec le formateur. L'accès à l'environnement d'apprentissage (support de cours, labs) ainsi qu'aux preuves de suivi (émargement, évaluation) est assuré.

 

Organisation
Les cours ont lieu de 9h à 12h30 et de 14h à 17h30.

 

Profil formateur
Nos formateur sont des experts dans leurs domaines d'intervention. Leur expérience du terrain et leurs qualités pédagogiques constituent un gage de qualité.

 

A l'attention des personnes en situation de handicap
Les personnes atteintes de handicap souhaitant suivre cett
e formation sont invitées à nous contacter directement, afin d'étudier ensemble les possibilités de suivre la formation

bottom of page