Notes: Accueil. Annoncez la promesse de la séance : « À la fin, vous saurez exactement ce qu'est un agent, comment il tourne, comment le rendre sûr — et surtout quand ne PAS en utiliser un. »
Notes: 2 minutes max. Question de contrôle : « Qui exécute réellement l'appel d'outil ? » Si la salle hésite, refaites le rappel. Session 5 est le prérequis dur de cette séance.
Notes: Insistez sur le point 5 : une session sur les agents qui enseigne aussi à ne pas en abuser, c'est ce qui la rend crédible.
Notes: Accroche de la Séquence A. Demandez à la salle : « Pourquoi ne le fait-il pas ? » Laissez venir les réponses : pas d'accès aux systèmes (→ outils, Session 5), et surtout… il s'arrête après UNE réponse.
Notes: LE slide pivot de la séance. La ligne « Arrêt » est la distinction conceptuelle : le contrôle du « quand c'est fini » passe du code au modèle. Faites-le noter mot pour mot.
Notes: Message central de la session. Vous le répéterez au moins trois fois. Précisez tout de suite le malentendu fréquent : ce n'est PAS un autre modèle plus intelligent — souvent c'est exactement le même modèle, dans une architecture différente. L'agentivité est une propriété du système.
Notes: L'analogie tient toute la séance : l'assistant a des « mains » (outils), un plan, un bloc-notes, et des limites que vous lui fixez (garde-fous). Transition : « Regardons le moteur de cet assistant. »
Notes: Annoncez le plan des 4 slides suivants : un temps par slide, toujours illustré par TripDesk, notre agent de réservation de voyages. Présentez TripDesk et sa mission : « vol Paris–Lisbonne semaine du 14, compatible agenda, réserver, confirmer ». Ses 4 outils : `chercher_vols`, `consulter_agenda`, `reserver_vol`, `envoyer_confirmation`.
Notes: Percevoir = relire tout le contexte. À l'itération 1, c'est la mission seule ; ensuite, ça inclut tous les résultats d'outils accumulés. Teaser mémoire (slide 16).
Notes: C'est ici que vit le raisonnement du modèle. Mentionnez le terme *reasoning* et, en une phrase, le motif « ReAct » (Reasoning + Acting, raisonner + agir) que certains participants croiseront dans la littérature — même cycle, autre nom.
Notes: Lien explicite avec la Session 5 : l'appel d'outil EST le « agir ». Rappel sécurité : le modèle demande, votre code exécute. Sans outils, la boucle « réfléchit dans le vide » — elle ne peut que parler.
Notes: Insistez : l'observation n'a de valeur que si elle est *exploitée* au tour suivant. Un agent qui reçoit les erreurs mais n'en tient pas compte est une boucle morte (exercice 2 tout à l'heure). Transition : « Voyons la boucle tourner en vrai. »
Notes: Basculez sur `webpage/index.html` pendant ~15 min. Commentez CHAQUE étape interne (percevoir/réfléchir/agir/observer) à voix haute. Trois choses à pointer : les compteurs itérations/budget (garde-fous), le panneau bloc-notes qui grossit (mémoire), et la décision d'arrêt finale prise par l'agent. Puis pause 10 min.
Notes: Reprise après la pause. Le plan est produit par le modèle lui-même (souvent déclenché par le prompt système : « établis un plan avant d'agir »). C'est du texte dans le contexte — rien de magique, pas une fonctionnalité cachée de l'API (Application Programming Interface, interface de programmation applicative).
Notes: Point d'insistance : un plan agentique est une hypothèse de travail. La force d'un agent n'est pas d'avoir un bon plan initial, c'est de le réviser quand les observations le contredisent. Un agent rigide qui suit un plan périmé = un workflow déguisé qui échoue.
Notes: Question à la salle avant d'afficher : « Entre l'itération 1 et la 4, où sont stockés les 3 vols ? » Analogie : le bloc-notes d'un enquêteur pendant une affaire. Conséquence pratique : un agent qui boucle 50 fois avec des résultats volumineux sature sa fenêtre → techniques de résumé/troncature.
Notes: Confusion fréquente à tuer explicitement : non, l'agent ne « se souviendra » pas de la mission précédente par défaut. Rien n'est écrit dans les poids du modèle pendant l'exécution. Teaser : la mémoire persistante fera l'objet d'une session ultérieure.
Notes: Séquence garde-fous. Reliez explicitement à la distinction clé du slide 5 : c'est PARCE QUE l'agent décide de sa fin qu'il faut des limites. Les garde-fous ne brident pas l'agent — ils rendent son autonomie acceptable en production.
Notes: À faire noter tel quel : c'est le kit minimal de tout agent en production, pas une option. Règle pratique : toute action irréversible ou coûteuse passe par un humain. Lire des vols : autonome. Payer un billet : validation. Prolongement direct du moindre privilège (Session 5).
Notes: Rejouez mentalement l'itération 4 de la démo. Anti-motif à nommer : réessayer À L'IDENTIQUE en boucle — c'est exactement ce que le garde-fou d'itérations max vient stopper. Un agent qui se rattrape, c'est ce qui le distingue le plus visiblement d'un simple script.
Notes: Écho direct de la Session 5 (« les descriptions d'outils sont des prompts »). Le modèle n'adapte sa stratégie qu'à partir de ce qu'il LIT. La robustesse d'un agent se conçoit côté outils autant que côté modèle. C'est la question 4 bonus de l'exercice 2.
Notes: Court (2 min). Sans journal, un agent qui déraille est une boîte noire. Avec journal, l'exercice 2 devient possible : on lira ensemble le log d'un agent parti en vrille. Transition vers la séquence esprit critique.
Notes: Faites voter la salle à main levée sur 3–4 exemples (résumé, traduction, météo, réservation multi-contraintes). Le contraste doit être évident. Les agents sont à la mode : votre valeur de professionnel, c'est de savoir dire « pas d'agent ici ».
Notes: L'arbre est interactif dans la webpage — montrez-le brièvement, les participants l'exploreront chez eux. Formule à faire noter : « Prompt < outil unique < workflow fixe < agent : toujours l'arme la plus simple qui accomplit la mission. »
Notes: 3–5 min. Prenez 2–3 cas proposés par les participants et classez-les ensemble avec l'arbre. C'est souvent le moment le plus riche de la session — les cas réels révèlent les nuances (beaucoup de « faux agents » sont en réalité de bons workflows).
Notes: 10 min. Circulez entre les binômes. Erreur à guetter : rembourser AVANT d'avoir vérifié la commande. Question piège à poser aux binômes rapides : « Où placez-vous la validation humaine, et pourquoi pas ailleurs ? »
Notes: Relisez les 6 points à voix haute, lentement. Puis quiz express à l'oral (questions 1, 3, 5, 7, 10 du quiz) et distribution des exit tickets.
Notes: Terminez à l'heure. Rappelez que le visualiseur fonctionne hors ligne : ils peuvent rejouer TripDesk et l'arbre de décision chez eux. Collectez les exit tickets à la sortie — c'est votre thermomètre pour ajuster la Session 7.