Aller au contenu principal

Récapitulation et examen final

Dix modules pour tenir un modèle de prévision de la demande de bout en bout sur Azure Machine Learning, du groupe de ressources vide au pipeline hebdomadaire supervisé. Voici le cours condensé et les fils qui le traversent.

Le cours d'un coup d'œil

ModuleL'essentiel à retenir
1. Espace de travailUn workspace agrège cinq satellites dans un groupe de ressources unique ; l'identité gérée porte les accès
2. Cibles de calculInstance pour dev, grappe avec min-instances: 0, calcul sans serveur pour l'occasionnel, priorité basse pour le balayage
3. DonnéesMagasin = connexion, actif = référence versionnée ; MLTable fige la liste de fichiers et rend le lignage crédible
4. EnvironnementsCurated pour le standard, custom avec versions épinglées et jamais @latest en production
5. Tâchescommand job avec MLflow auto-configuré ; balayage bayésien avec early_termination pour explorer à coût maîtrisé
6. AutoMLBaseline forte sur les tabulaires bien cadrés, time_series_id_column_names obligatoire en prévision, coût à budgétiser
7. Registremlflow_model pour le déploiement sans code ; balise stade pour piloter la promotion, registre partagé pour séparer les permissions
8. Points de terminaisonRépartition du trafic entre déploiements pour le bleu-vert ; en ligne pour la latence, par lots pour le volume
9. PipelinesComposants réutilisables, pipeline YAML, cache d'étape, planification récurrente ou déclenchement événementiel
10. Coûtsmin-instances: 0, arrêt automatique, balises de projet, dimensionner sur le p99 réel du trafic

Les fils qui traversent le cours

Tout passe par une identité et une version. L'identité gérée du workspace accède aux données et aux images sans secret dans le code (module 1). Les données sont référencées par version d'actif (3), les environnements par version d'image (4), les modèles par version enregistrée (7), les composants par version publiée (9). C'est cette chaîne de versions qui permet, six mois plus tard, de rejouer exactement une exécution.

Le mauvais réflexe coûte l'ordre de grandeur. Une grappe à min-instances: 1 facture 24 h sur 24 pour un usage de 40 minutes par semaine — plusieurs milliers de dollars par an gaspillés. Un environnement sans version épinglée casse une nuit sans laisser de trace. Un point de terminaison surdimensionné rend le poste le plus visible de la facture. Chaque module a signalé ces pièges parce qu'ils sont, de loin, la première cause d'échec de projet Azure ML.

AutoML est un compagnon de route, pas un remplaçant. Il excelle sur les tabulaires standard et sert de baseline forte au démarrage. Il ne remplace ni l'expertise domaine sur la fraude ou la maintenance, ni l'ingénierie de variables sur un jeu où l'humain a un vrai avantage. Le fil rouge de la prévision de demande l'a montré : AutoML a été utile en semaine 1, dispensable ensuite.

Correspondance avec SageMaker et Vertex

Le vocabulaire diffère mais les objets se recoupent :

ConceptAzure MLSageMakerVertex AI
Espace de travailworkspaceStudio DomainVertex AI Workbench
Grappe managéeAmlComputeTraining InstanceCustom Training Job
Point d'entrée donnéesMLTable, Data AssetS3 URI, Feature StoreDataset, Feature Store
RegistreModel RegistryModel RegistryModel Registry
Point en ligneManaged Online EndpointReal-time EndpointOnline Endpoint
PipelinePipeline JobSageMaker PipelinesVertex Pipelines
AutoMLAutoMLAutopilotAutoML Tables

Les compétences acquises se transposent : maîtriser le lignage de version sur Azure ML rend l'apprentissage du même concept sur Vertex AI presque immédiat.

L'examen final

L'examen comporte 40 questions qui couvrent les dix modules : identités et rôles, choix de cible de calcul, contrat des MLTable, versionnage des environnements, définition d'une tâche et lecture de MLflow, réglages critiques d'AutoML, promotion et lignage dans le registre, répartition de trafic sur un point de terminaison, pipelines et déclencheurs, quotas et coûts.

Plusieurs questions présentent des situations à diagnostiquer : une grappe qui ne descend pas à zéro, une tâche qui refuse de démarrer parce que l'identité n'a pas l'accès au stockage, un modèle qui explose en latence après passage en stacked ensemble, un pipeline qui écrase silencieusement un modèle validé. C'est le jugement qui est évalué, pas la récitation.

En cas de réussite, votre attestation d'achèvement est délivrée immédiatement ; son numéro est vérifiable par tout tiers sur la plateforme.

Avant de commencer

Reprenez le tableau ci-dessus. Pour chaque ligne, demandez-vous « quel est le piège le plus fréquent ? » : la grappe qui reste allumée, le latest qui casse la production, l'ensemble empilé qui explose la latence, le quota qui tombe le lundi matin. Si vous savez répondre à ces quatre questions, vous êtes prêt. Bonne chance !

Examen final

Prêt à valider ce cours ?

40 questions tirées au hasard dans la banque du cours · seuil de réussite 70 % · certificat PDF vérifiable délivré immédiatement en cas de réussite.

Commencer l'examen

Connexion à votre compte InSkillML et abonnement actif requis. Vous pouvez aussi lancer l'examen depuis Mes cours.