Objectifs pédagogiques

À l’issue de la formation, le participant sera en mesure de :
Comprendre le principe de la modélisation statistique
Choisir entre la régression et la classification en fonction du type de données
Évaluer les performances prédictives d'un algorithme
Créer des sélections et des classements dans de grands volumes de données pour dégager des tendances

Public concerné

Responsables Infocentre (Datamining, Marketing, Qualité...), utilisateurs et gestionnaires métiers de bases de données.

Prérequis

Connaissances de base en Python. Connaissances de base en statistiques ou avoir suivi le stage "Statistiques, maîtriser les fondamentaux" (Réf. STA).

Programme de la formation

Introduction à la modélisation
Introduction au langage Python.
Introduction au logiciel Jupiter Notebook.
Les étapes de construction d'un modèle.
Les algorithmes supervisés et non supervisés.
Le choix entre la régression et la classification.

Travaux pratiques

Installation de Python 3, d'Anaconda et de Jupiter Notebook.

Procédures d'évaluation de modèles

Les techniques de ré-échantillonnage en jeu d'apprentissage, de validation et de test.
Test de représentativité des données d'apprentissage.
Mesures de performance des modèles prédictifs.
Matrice de confusion, de coût et la courbe ROC et AUC.

Travaux pratiques

Mise en place d'échantillonnage de jeux de donnes. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

Les algorithmes supervisés

Le principe de régression linéaire univariée.
La régression multivariée.
La régression polynomiale.
La régression régularisée.
Le Naive Bayes.
La régression logistique.

Travaux pratiques

Mise en œuvre des régressions et des classifications sur plusieurs types de données.
Les algorithmes non supervisés
Le clustering hiérarchique.
Le clustering non hiérarchique.
Les approches mixtes.

Travaux pratiques

Traitements de clustering non supervisés sur plusieurs jeux de données.

Analyse en composantes

Analyse en composantes principales.
Analyse factorielle des correspondances.
Analyse des correspondances multiples.
Analyse factorielle pour données mixtes.
Classification hiérarchique sur composantes principales.

Travaux pratiques

Mise en œuvre de la diminution du nombre des variables et identification des facteurs sous-jacents des dimensions associées à une variabilité importante.

Analyse de données textuelles

Collecte et prétraitement des données textuelles.
Extraction d'entités primaires, d'entités nommées et résolution référentielle.
Étiquetage grammatical, analyse syntaxique, analyse sémantique.
Lemmatisation.
Représentation vectorielle des textes.
Pondération TF-IDF.
Word2Vec.

Travaux pratiques

Explorer le contenu d'une base de textes en utilisant l'analyse sémantique latente.

Projet final

Data Analytics est un terme pour exprimer les démarches d'analyse de données, afin d'être en mesure de prendre des décisions. Le langage Python dispose d'un écosystème permettant les traitements statistiques : de la construction de modèles d'analyse, à leur évaluation jusqu'à leur représentation.

Nous couvrirons les cours suivants:

Oozon Oozons

Membre

-.-

Sur 5.0

5stars

(90%)

4stars

(65%)

3stars

(49%)

2stars

(25%)

1stars

(15%)

-- Share -- -- --

Formations Recommandées

Popular

Data Analytics avec Python...

4.2

(0)

90 000 XOF

Popular

Power BI, concevoir des tableaux de bord...

Power BI, la solution de Data Visualisation de Microsoft permet de créer des tableaux de bord, riches et interactifs grâce aux multiples éléments graphiques qu'elle propose. Cette formation vous familiarisera avec son environnement et vous permettra de manipuler des données et de créer vos rapports.

4.2

(0)

90 000 XOF

Popular

Traitement de données Big Data en temps réel avec Spark et Storm...

Le Big Data, connu pour sa capacité à traiter des données massives, intègre avec l'arrivée d'outils comme Spark et Storm la composante temps réel. Vous découvrirez dans ce cours les atouts de ces outils, leur système de calcul distribué temps réel ainsi que la notion de diffusion en continue (Streaming Big Data).

4.2

(0)

90 000 XOF

0.0

S'enroller Maintenant

Mot Clés

Recherche

Nos Formateurs

Oozons
Tout

--

Data Analytics avec Python

Objectifs pédagogiques

Public concerné

Prérequis

Programme de la formation

Travaux pratiques

Procédures d'évaluation de modèles

Travaux pratiques

Les algorithmes supervisés

Travaux pratiques

Travaux pratiques

Analyse en composantes

Travaux pratiques

Analyse de données textuelles

Travaux pratiques

Projet final

Oozon Oozons

-.-

Formations Recommandées

Data Analytics avec Python...

4.2

90 000 XOF

Power BI, concevoir des tableaux de bord...

4.2

90 000 XOF

Traitement de données Big Data en temps réel avec Spark et Storm...

4.2

90 000 XOF

Mot Clés

Recherche

Nos Formateurs

Newsletter

Categories

Cours

Oozons

Support