Prenez contact avec nous

Plan du cours

Introduction

Cette section offre une introduction générale sur les moments propices à l'utilisation du 'machine learning', les éléments à considérer et la signification de l'ensemble, y compris les avantages et les inconvénients. Types de données (structurées/non structurées/statiques/en flux), validité et volume des données, analyse pilotée par les données par rapport à l'analyse pilotée par l'utilisateur, modèles statistiques par rapport aux modèles de machine learning, défis de l'apprentissage non supervisé, compromis biais-variance, itération/évaluation, approches de validation croisée, apprentissage supervisé/non supervisé/apprentissage par renforcement.

SUJETS MAJEURS

1. Comprendre Naive Bayes

  • Concepts de base des méthodes bayésiennes
  • Probabilité
  • Probabilité conjointe
  • Probabilité conditionnelle avec le théorème de Bayes
  • L'algorithme Naive Bayes
  • La classification Naive Bayes
  • L'estimateur de Laplace
  • Utilisation de fonctionnalités numériques avec Naive Bayes

2. Comprendre les arbres de décision

  • Diviser pour mieux régner
  • L'algorithme d'arbres de décision C5.0
  • Choisir la meilleure partition
  • Élaguer l'arbre de décision

3. Comprendre les réseaux de neurones

  • Des neurones biologiques aux neurones artificiels
  • Fonctions d'activation
  • Topologie du réseau
  • Le nombre de couches
  • La direction du flux d'information
  • Le nombre de nœuds par couche
  • Entraînement des réseaux de neurones avec la rétropropagation
  • Deep Learning

4. Comprendre les machines à vecteurs de support

  • Classification avec des hyperplans
  • Trouver la marge maximale
  • Le cas des données linéairement séparables
  • Le cas des données non linéairement séparables
  • Utilisation de noyaux pour les espaces non linéaires

5. Comprendre le clustering

  • Le clustering en tant que tâche de machine learning
  • L'algorithme k-means pour le clustering
  • Utilisation de la distance pour attribuer et mettre à jour les clusters
  • Choisir le nombre approprié de clusters

6. Mesurer la performance de la classification

  • Travailler avec des données de prédiction de classification
  • Examen approfondi des matrices de confusion
  • Utilisation des matrices de confusion pour mesurer la performance
  • Au-delà de la précision – autres mesures de performance
  • La statistique kappa
  • Sensibilité et spécificité
  • Précision et rappel
  • La mesure F
  • Visualisation des compromis de performance
  • Courbes ROC
  • Estimation de la performance future
  • La méthode holdout
  • Validation croisée
  • Échantillonnage Bootstrap

7. Réglage des modèles standard pour une meilleure performance

  • Utilisation de caret pour le réglage automatique des paramètres
  • Création d'un modèle réglé simple
  • Personnalisation du processus de réglage
  • Amélioration de la performance des modèles avec la méta-apprentissage
  • Comprendre les ensembles
  • Bagging
  • Boosting
  • Forêts aléatoires
  • Entraînement des forêts aléatoires
  • Évaluation de la performance des forêts aléatoires

SUJETS MINEURS

8. Comprendre la classification avec le plus proche voisin

  • L'algorithme kNN
  • Calcul de la distance
  • Choisir un k approprié
  • Préparation des données pour l'utilisation avec kNN
  • Pourquoi l'algorithme kNN est-il paresseux ?

9. Comprendre les règles de classification

  • Séparer pour mieux régner
  • L'algorithme One Rule
  • L'algorithme RIPPER
  • Règles issues des arbres de décision

10. Comprendre la régression

  • Régression linéaire simple
  • Estimation par les moindres carrés ordinaires
  • Corrélations
  • Régression linéaire multiple

11. Comprendre les arbres de régression et les modèles arborescents

  • Ajout de la régression aux arbres

12. Comprendre les règles d'association

  • L'algorithme Apriori pour l'apprentissage des règles d'association
  • Mesure de l'intérêt des règles – support et confiance
  • Construction d'un ensemble de règles avec le principe Apriori

Extras

  • Spark/PySpark/MLlib et bandits multi-bras

Pré requis

Connaissances de Python

 21 Heures

Nombre de participants


Prix par participant

Nos clients témoignent (7)

Cours à venir

Catégories Similaires