Carte conceptuelle du cours
Dépendances entre les notions du cours, du plus fondamental au plus avancé. Suivez les flèches pour identifier les prérequis avant d'aborder un sujet.
Vue d'ensemble
Description textuelle
Le parcours commence par les fondements (donnée, variables, matrice de design, cycle de vie), puis la formalisation (f(x)=y+ε), la notion de généralisation et les phénomènes de sous/sur-apprentissage. On bifurque ensuite :
- Apprentissage supervisé : classification (régression logistique, KNN, SVM, arbres, forêts aléatoires) et régression (MCO, régression simple, multiple, polynomiale). Chaque branche se termine par ses métriques d'évaluation.
- Apprentissage non supervisé : clustering par partitionnement (K-Means / Lloyd) et clustering hiérarchique (dendrogramme, fonctions de lien).
Ordre d'apprentissage conseillé
- Maîtriser la notion de donnée et la matrice X (chapitres 1 et 2).
- Comprendre la formalisation f(x)=y+ε et la généralisation (chapitre 3).
- Aborder la classification : logistique, KNN, SVM, arbres, forêts (chapitre 4).
- Assimiler le protocole d'évaluation et les métriques (chapitre 5).
- Appliquer sur les ateliers (chapitre 6).
- Étudier la régression et le MCO (chapitres 7 et 8).
- Terminer par le non supervisé : K-Means puis hiérarchique (chapitres 9 à 11).