Apprentissage non supervisé
Découverte de structures dans des données sans étiquettes : partitionnement, réduction de dimension et détection d'anomalies.
Durée du cours : 6h
Ce que vous allez apprendre
- Segmenter une population sans étiquettes préalables
- Choisir le nombre de groupes avec des critères défendables
- Réduire la dimension sans détruire le signal utile
- Visualiser des données à grande dimension de façon honnête
- Repérer des anomalies dans un flux de mesures
Prérequis
- Python et pandas
- Notions d'algèbre linéaire
Modules du cours
- Ce que l'on cherche quand il n'y a pas d'étiquettes
- k-moyennes : principe, initialisation et limites
- Choix du nombre de groupes : coude et score de silhouette
- Partitionnement hiérarchique et dendrogrammes
- DBSCAN et groupes de forme quelconque
- Analyse en composantes principales
- t-SNE et UMAP : lecture prudente des projections
- Détection d'anomalies : forêt d'isolement et méthodes statistiques
- Modèles de mélange gaussien
- Projet : segmentation de clientèle documentée
Évaluation et attestation
Le parcours se termine par un examen de 40 questions qui couvre tous les modules. En cas de réussite, une attestation d'achèvement est délivrée ; son numéro est vérifiable sur la plateforme.
Les cours gratuits, eux, se concluent par un quiz de 5 questions avec un aperçu de l'attestation, sans certification.