Micropole Institut

Data Science - Les fondamentaux

Par Micropole Institut

Objectifs

Cette formation Data Science, les fondamentaux vous permettra de :

  • Savoir reconnaître une problématique business qui profiterait de l'apport de la data science
  • Mettre en place une gouvernance projet dédié
  • Choisir les bons outils en fonction de la problématique

Programme

Data science et data mining

  • Introduction au data mining
  • Différence entre data science, data mining, machine learning
  • Les principales méthodes en data science :
  • Le machine learning : réseau de neurone, boosting et bagging, gradient boosting, random forest
  • Le data mining : régression, k-meeans, techniques d'association Introduction au deep learnin

Principe du big data

  • L'architecture distribuée
  • Principes d'un cluster Hadoop : Le map reduce et Yarn Le HDFS Les daemon

Les étapes d'un projet de data science

  • Overview des principaux outils de la data science
  • Les distributions Hadoop
  • Les solutions open source : les solutions Apache (hive, pig), Python, R Les solutions payantes : SAS, IBM (Modeler, DSX), Dataiku, Datameer, les PaaS (AWS, Microsoft Azure, Bluemix) …

Pédagogie

1 poste et 1 support par stagiaire
8 à 10 stagiaires par salle
Remise d'une documentation pédagogique papier ou numérique pendant le stage
La formation est constituée d'apports théoriques, d'exercices pratiques, de réflexions et de retours d'expérience

Formations de la même catégories (5)

M2i Formation
MapR - Architecture et administrationPar M2i Formation
  • Maîtriser l'administration des clusters MapR.
Dawan
Informix Database Initiation + ApprofondissementPar Dawan

Réaliser des schémas et requêtes quelconques sur Informix - Décrire l'architecture multi-tâches IBM Informix Dynamic Server - Installer, maintenir, administrer et optimiser un serveur IDS

Global Knowledge
Big Data : Architecture et technologiesPar Global Knowledge

Ce cours de synthèse vous présentera les enjeux et les apports du Big Data ainsi que les technologies pour sa mise en œuvre. Vous apprendrez à gérer un projet de gestion de données massives depuis l'installation d'une plateforme Big Data, tout en passant par la gestion, l'analyse et la visualisation des données.

Dawan
Apache Kafka : Echange de donnéesPar Dawan

Comprendre l’architecture de Kafka et ses cas d’utilisation - Utiliser les APIs Kafka - Administrer un cluster - Construire une architecture haute-disponibilité - Sécuriser un cluster

Orsys
Flink, développer des applications pour le Big DataPar Orsys

Apache Flink est un nouvel outil de traitement de Big Data de quatrième génération qui change le paysage des technologies de traitement des données. Ce cours vous permettra d’utiliser Apache Flink pour développer des applications en Java en vue de traiter des flux massifs de données issues du Big Data en temps réel.

Nous utilisons les cookies afin de fournir les services et fonctionnalités proposés sur notre site et afin d’améliorer l’expérience de nos utilisateurs. En cliquant sur ”J’ai compris”, vous acceptez l’utilisation de ces cookies.