Aller au contenu principal

Récapitulation et examen final

Dix modules pour passer d'un appel de modèle à un agent qui décide, agit et se mesure. Voici le cours condensé, les fils qui le traversent et la liste de contrôle d'un agent en production.

Le cours d'un coup d'œil

ModuleL'essentiel à retenir
1. Agent, chaîne, appelUn agent délègue le choix des étapes ; on préfère souvent une chaîne.
2. Boucle ReActPensée, action, observation ; condition d'arrêt quantitative obligatoire.
3. OutilsLa description dit quand appeler et quand ne pas appeler ; valider les arguments.
4. MémoireContexte pour le travail, base vectorielle pour la mémoire longue ; résumé glissant au-delà de 15 000 jetons.
5. PlanificationPlan si plus de trois étapes ; jusqu'à trois révisions avec historique protégé.
6. AutocritiqueRéflexion, vérificateur, outil objectif — seul le dernier garantit ; méfiance envers l'autocorrection illusoire.
7. Garde-fousBudgets itérations/jetons/temps, trois niveaux de permission, points d'arrêt humains, bac à sable.
8. ÉchecsSix patrons nommés ; correctifs structurels plutôt que patches de prompt.
9. ObservabilitéJournal JSON par exécution, mise en cache de contexte, rejeu déterministe.
10. Projet30 questions catégorisées, 70 % correct complet, 0,34 EUR moyen, décision de production argumentée.

Les fils qui traversent le cours

Un agent est un système, pas un prompt. La logique tient en 60 lignes ; le reste — outils validés, mémoire disciplinée, garde-fous, journal, jeu d'évaluation — occupe l'essentiel du code et fait toute la différence entre un jouet et un outil de production. Chaque module ajoute une brique à ce système ; aucune n'est optionnelle en production.

La délégation du contrôle a un prix mesurable. Multiplier les étapes multiplie les appels, la latence et surtout la variance. Le module 1 pose le prix, les modules 2 et 7 le bornent, le module 9 le rend visible. Une équipe qui ne mesure pas ce prix ne pilote rien.

Ce qui rend un agent fiable, ce sont ses points de contact avec le monde extérieur. Les outils sont l'interface (module 3), les observations sont la porte d'entrée des attaques (module 8), les actions sont l'endroit où les dégâts se produisent (module 7). Concevoir un agent revient à concevoir ces interfaces bien avant de concevoir un prompt clever.

Corriger un agent structurellement plutôt que textuellement. Les modules 6 et 8 le disent séparément. Un correctif dans le prompt tient rarement la nuit ; un outil ajouté, un filtre imposé, une permission par défaut tient. Le prompt système reste court, la robustesse est en dehors.

Liste de contrôle d'un agent en production

  • La condition d'arrêt est quantitative (« trois sources concordantes ou huit pages »), pas qualitative.
  • Une limite dure d'itérations, une limite de jetons et un délai sont posés ; le dépassement lève une exception attrapée qui rend l'état courant.
  • Chaque outil a une description qui dit quand ne pas l'appeler et un nom parallèle aux autres outils.
  • Les arguments sont validés (Pydantic ou équivalent) avant exécution ; une erreur devient un message exploitable pour le modèle, pas une exception silencieuse.
  • Le contexte est plafonné, avec un résumé glissant qui préserve les faits sourcés et les décisions prises.
  • Un journal des décisions protège de l'oscillation en cas de replanification.
  • La vérification est objective (outil) ou en consensus (trois passes) ; on se méfie de l'autocritique par le même modèle.
  • Tout outil « effet extérieur » est classé comme tel par défaut ; ouvrir l'automatisation exige un choix explicite.
  • Un enregistrement JSON par exécution capture pensée, action, observation, coût, statut ; les observations sont archivées pour rejeu.
  • Un jeu d'évaluation d'au moins 30 questions catégorisées existe, avec un verdict humain reproductible.
  • Trois indicateurs sont sous alerte : taux de bonnes réponses, coût p50/p90/p99, taux d'arrêt par budget.

L'examen final

L'examen comporte 40 questions couvrant les dix modules : distinction agent/chaîne, boucle et condition d'arrêt, description d'outils, mémoire et résumé, planification et replanification, autocritique et ses limites, garde-fous et permissions, échecs typiques et correctifs, observabilité et coût, mise en production.

Plusieurs questions présentent des situations à diagnostiquer : un agent qui boucle sur la même requête, un vérificateur qui valide un chiffre transposé, une page web qui contient une injection, une sortie qui dérive du sujet. C'est le jugement qui est évalué — nommer la panne, choisir le correctif structurel — pas la récitation d'un vocabulaire.

En cas de réussite, votre attestation d'achèvement est délivrée immédiatement ; son numéro est vérifiable par tout tiers sur la plateforme.

Avant de commencer

Reprenez la liste de contrôle ci-dessus. Pour chaque ligne, demandez-vous « saurais-je écrire le code qui garantit cette propriété ? ». Si vous savez borner un budget, refuser un outil non fiable, distinguer les trois modes de vérification et diagnostiquer les six échecs typiques, vous êtes prêt. Bonne chance !

Examen final

Prêt à valider ce cours ?

40 questions tirées au hasard dans la banque du cours · seuil de réussite 70 % · certificat PDF vérifiable délivré immédiatement en cas de réussite.

Commencer l'examen

Connexion à votre compte InSkillML et abonnement actif requis. Vous pouvez aussi lancer l'examen depuis Mes cours.