AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Agents and Workflows

D2 · Defining Objectives and Tasks

Spécifier un objectif délégable — but, définition de « terminé », contraintes, sources de vérité et points de contrôle — et gérer l’ambiguïté avant qu’un agent ne commence à travailler.

C’est l’un des deux domaines les plus lourds — 18 %, environ 9 des 50 items de notre examen blanc. Il teste si vous savez transformer un souhait en un brief qu’un agent peut réellement exécuter et que vous pouvez réellement vérifier. La plupart des délégations ratées se décident ici : un agent à qui l’on donne un objectif vague produit un travail vague, et vous ne pouvez pas dire s’il a réussi parce que vous n’avez jamais dit ce qu’était le succès. La compétence que ce domaine récompense est d’écrire l’objectif, pas d’écrire le prompt.

Ce qu’il faut savoir

Un objectif délégable a cinq parties : un but (le résultat, énoncé comme un aboutissement et non une liste de tâches), une définition de « terminé » (le test d’acceptation que vous vérifierez), des contraintes (ce qu’il doit et ne doit pas faire), des sources de vérité (quelles entrées font autorité) et des points de contrôle (là où il fait une pause pour vous). Le but dit quoi ; la définition de « terminé » dit comment vous le saurez ; les contraintes et les sources bornent comment ; les points de contrôle contrôlent quand vous pouvez orienter. Quand un objectif est ambigu, le bon geste n’est presque jamais de laisser l’agent deviner — c’est d’affiner le brief, ou d’ordonner à l’agent de demander avant de poursuivre sur le point ambigu. Un bon brief est celui que vous pourriez remettre à une nouvelle recrue compétente qui ne posera pas de questions de clarification.

Objectifs d’apprentissage

À la fin de cette page, vous devriez être capable de :

  1. Écrire un objectif comme un résultat avec une définition de « terminé » testable.
  2. Séparer les contraintes du but, et les contraintes fermes des préférences.
  3. Nommer les sources de vérité qu’un agent devrait traiter comme faisant autorité, et les classer quand elles se contredisent.
  4. Placer les points de contrôle là où le risque ou l’incertitude est le plus élevé.
  5. Gérer un objectif ambigu sans laisser l’agent deviner silencieusement.
  6. Diagnostiquer une délégation ratée comme un défaut de brief avant de blâmer le modèle.

2.1 But : énoncez le résultat, pas les frappes clavier

L’erreur de briefing la plus fréquente est de décrire les étapes que vous suivriez au lieu du résultat que vous voulez. Les étapes contraignent un agent à votre chemin et l’empêchent de s’adapter ; un résultat le laisse planifier tout en restant vérifiable.

Faible (étapes / vague)Fort (résultat)
« Parcours les tickets et vois ce qui se passe »« Produis une liste des cinq problèmes de support les plus fréquents ce mois-ci, avec un décompte et un exemple de ticket chacun »
« Aide avec la newsletter »« Rédige une newsletter client de 300 mots annonçant la release de mars, dans notre ton maison, prête pour revue »
« Analyse les données de vente »« Identifie quelles deux régions ont manqué leur objectif du T1 et la principale cause unique pour chacune, en citant les chiffres »

Signal d’évaluation

Les énoncés qui disent que l’objectif est « d’aider avec », « d’examiner » ou « de travailler sur » quelque chose signalent un défaut de but — la réponse est de reformuler l’objectif en un résultat concret et vérifiable, pas d’ajouter des outils ou un modèle plus grand.

2.2 Définition de « terminé » : le test d’acceptation

La définition de « terminé » est ce qui sépare une tâche délégable d’un souhait. C’est la checklist que vous ferez tourner contre le résultat — elle doit donc être observable, pas un ressenti.

text
BUT : Produire une synthèse de la tarification concurrente pour le deck de direction.
DÉFINITION DE « TERMINÉ » (vérifiable) :
[ ] Couvre les quatre concurrents nommés
[ ] Un point de prix par palier de produit, sourcé sur une page publique avec un lien
[ ] Une ligne « ce qui a changé depuis le trimestre dernier » par concurrent
[ ] Tient sur une slide (≤ 6 puces)
[ ] Signale tout chiffre qu’il n’a pas pu vérifier plutôt que de deviner

Une bonne définition de « terminé » fait trois choses : elle dit à l’agent quand s’arrêter, elle vous dit quoi vérifier, et — crucialement — elle dit à l’agent quoi faire quand il ne peut pas satisfaire un critère (le signaler, ne pas le fabriquer). Comparez à « fais une synthèse de tarification », où aucune des parties ne sait ce que « terminé » signifie.

Propriété d’une bonne définition de « terminé »Pourquoi c’est important
ObservableVous pouvez la cocher sans jugement
ComplèteCouvre chaque partie du but, donc rien n’est silencieusement abandonné
BornéeÉnonce une taille/un périmètre pour que l’agent s’arrête au bon endroit
Consciente de l’échecDit quoi faire quand un critère ne peut pas être satisfait (signaler, pas fabriquer)

2.3 Contraintes : règles fermes contre préférences

Les contraintes bornent comment le travail est fait. La distinction critique est entre les contraintes fermes (les violer rend la sortie inutilisable ou dangereuse) et les préférences (un plus). Un agent qui traite une préférence comme ferme gaspille des efforts ; un agent qui traite une contrainte ferme comme une préférence produit un travail inutilisable ou dangereux.

Type de contrainteExempleConséquence de la violation
Ferme — sécurité/juridique« N’inclus jamais le numéro de compte complet d’un client »Dangereux ; violation potentielle
Ferme — factuelle« N’utilise que les chiffres du rapport joint »Sortie erronée ; ne peut pas faire confiance
Ferme — périmètre« Ne contacte aucun fournisseur directement »Action externe irréversible
Préférence — style« Préfère les puces à la prose »Sous-optimal, toujours utilisable
Préférence — longueur« Vise environ une page »Plus long est acceptable si nécessaire

Écrivez les contraintes fermes comme des interdictions que l’agent doit respecter (must not, only, never) et marquez les préférences comme telles. D2 développe le point supplémentaire qu’une contrainte ferme sur une action irréversible doit souvent être imposée par le système, pas simplement énoncée dans le brief.

2.4 Sources de vérité : ce qui fait autorité

Un agent mélangera volontiers un chiffre faisant autorité avec un chiffre périmé du web ouvert, à moins que vous ne lui disiez quelle source l’emporte. Nommer les sources de vérité — et les classer — est ce qui maintient une délégation ancrée.

Le brief dit…L’agent va…
Rien sur les sourcesUtiliser ce qu’il trouve, y compris des données périmées ou fausses
« Utilise le rapport T1 joint pour tous les chiffres »Ancrer les nombres dans le document faisant autorité
« Préfère la feuille de tarification partagée ; si elle est muette, utilise le site public et signale-le »Classer les sources et faire remonter l’incertitude
« La connaissance de l’entreprise pour la politique, le système de tickets pour les faits sur ce cas »Router chaque fait vers la bonne source
text
ordre de résolution des conflits (exemple)
┌────────────────────────────────────────┐
1 ► │ le document que j’ai joint à cette tâche │ fait le plus autorité
2 ► │ connaissance / politique entreprise approuvée │
3 ► │ le système de référence en direct (tickets, CRM) │
4 ► │ le web public │ le moins — et signaler
└────────────────────────────────────────┘

Signal d’évaluation

Quand un énoncé décrit un agent mélangeant des chiffres corrects et incorrects, ou utilisant un nombre périmé, la cause racine est habituellement une source de vérité manquante, et le correctif est de nommer et classer les sources faisant autorité — pas de baisser la température ou de changer de modèle.

2.5 Points de contrôle : où faire une pause pour un humain

Les points de contrôle sont les points d’orientation que vous intégrez dans l’objectif. Ils appartiennent là où l’incertitude ou le risque est le plus élevé — pas régulièrement espacés, et pas uniquement à la fin. Un point de contrôle à la fin est une revue ; un point de contrôle en cours d’exécution est une chance de corriger le cap avant que le travail gaspillé ne s’accumule.

Placez un point de contrôle…Parce que
Avant toute action irréversibleVous ne pouvez pas annuler un envoi, une publication ou un paiement
Après le plan, avant l’exécutionL’endroit le moins cher pour saisir un objectif mal lu
À une bifurcation où l’agent a dû devinerConfirmez l’hypothèse avant qu’elle se propage
Avant de passer à l’échelle d’un item à plusieursVérifiez le motif sur un avant qu’il se répète cinquante fois

Le point de contrôle « un avant plusieurs » est le plus précieux de cet examen : faites faire à l’agent le premier item, faites une pause, laissez-le approuver l’approche, puis exécutez le reste. Cela convertit une erreur en cinquante exemplaires en une erreur unique.

2.6 Gérer un objectif ambigu

Quand l’objectif est ambigu, laisser l’agent choisir silencieusement une interprétation est la mauvaise réponse presque à chaque fois. Il y a trois gestes légitimes, par ordre de préférence :

  1. Résolvez-le vous-même avant de déléguer — le correctif le moins cher quand vous connaissez la réponse.
  2. Ordonnez à l’agent de demander sur le point ambigu spécifique avant de poursuivre (un point de contrôle sur la bifurcation).
  3. Énoncez une hypothèse explicite que l’agent doit faire et faire remonter, pour que vous puissiez en saisir une mauvaise à la revue.
text
L’objectif est ambigu
│
├─ Est-ce que je connais la bonne interprétation ? ── oui ─► résolvez-le dans le brief
├─ Est-ce une bifurcation unique et identifiable ? ── oui ─► dites à l’agent de faire une pause et de demander
└─ De nombreuses petites inconnues que je ne peux pas préanswer ? ─► dites-lui d’énoncer ses hypothèses
et de les signaler pour revue

La réponse piège est « laissez l’agent décider et allez vite ». La vitesse achetée par une mauvaise hypothèse non énoncée est une fausse économie — vous la remboursez en reprise, et pire si l’hypothèse a conduit à une action irréversible.

2.7 Une délégation ratée est d’abord un défaut de brief

Quand un agent renvoie la mauvaise chose, la réponse disciplinée est d’interroger le brief avant le modèle. La plupart des échecs correspondent à un élément de brief manquant.

SymptômeDéfaut de brief probable
A fait quelque chose d’adjacent à ce que vous vouliezBut énoncé comme une tâche, pas comme un résultat
« Terminé » mais la moitié du travail manqueAucune définition de « terminé » à vérifier
A utilisé un nombre périmé ou fauxAucune source de vérité nommée
A pris une action que vous ne vouliez pasAucune contrainte ferme, ou aucun point de contrôle
A deviné et s’est trompéAmbiguïté laissée à l’agent pour être résolue silencieusement

Cet état d’esprit — le brief d’abord, le modèle ensuite — est développé pleinement en D6. Ici, le point est qu’un objectif solide prévient la plupart des échecs avant qu’ils ne surviennent.

Cadre de décision

Utilisez le brief GDCSC — Goal, Done, Constraints, Sources, Checkpoints (But, Terminé, Contraintes, Sources, Points de contrôle) — comme modèle en cinq parties pour chaque délégation. Si une ligne est vide, la tâche n’est pas prête à déléguer.

ÉlémentLa question à laquelle il répondUne réponse faible ressemble àUne réponse forte ressemble à
Goal (But)Quel résultat je veux ?« Aide avec X »« Produis Y qui fait Z, prêt pour revue »
Done (Terminé)Comment saurai-je que c’est fini et correct ?« Quand c’est bien »Une liste vérifiable, bornée en taille, consciente de l’échec
Constraints (Contraintes)Que doit-il toujours/jamais faire ?(non énoncé)Règles fermes marquées must/never ; préférences marquées comme telles
SourcesQuelles entrées font autorité ?(non énoncé)Nommées et classées, avec ordre de conflit
Checkpoints (Points de contrôle)Où devrait-il faire une pause pour moi ?(aucun, ou seulement à la fin)Avant les étapes irréversibles et avant le passage à l’échelle un→plusieurs

Appliquez-le demain : prenez toute tâche que vous délégueriez, remplissez les cinq lignes, et ne déléguez que quand aucune n’est vide. Une ligne vide est exactement là où la délégation échouera.

Erreurs fréquentes

ErreurPourquoi elle survientQue faire à la place
Briefer les étapes au lieu du résultatVous décrivez comment vous le feriezÉnoncez le résultat ; laissez l’agent planifier le chemin
Aucune définition de « terminé »Le but semblait évidentÉcrivez la checklist d’acceptation avant de déléguer
Mélanger contraintes fermes et préférencesTout semble importantMarquez must/never vs « préférer » ; les agents ont besoin de la différence
Ne pas nommer de source de véritéVous avez supposé qu’il utiliserait les bonnes donnéesNommez et classez explicitement les sources faisant autorité
Points de contrôle uniquement tout à la finLa revue de fin semble suffisantePlacez un point de contrôle avant les étapes irréversibles et avant le passage à l’échelle un→plusieurs
Laisser l’agent résoudre l’ambiguïté silencieusementBiais « aller vite »Résolvez-la, ou dites à l’agent de faire une pause et de demander
Lui dire de combler les manques plutôt que de les signalerVous voulez une réponse d’apparence complèteOrdonnez : signalez ce que vous ne pouvez pas vérifier, ne fabriquez pas
Blâmer le modèle pour un brief vagueLa sortie était fausse, donc le modèle doit l’êtreInterrogez d’abord le brief — la plupart des échecs sont des défauts de brief

Mise en situation

Scénario. Devon, un chef de produit marketing sur ChatGPT Work, délègue : « Assemble une synthèse concurrentielle de la tarification de nos principaux concurrents pour le deck du conseil la semaine prochaine. » Une heure plus tard, l’agent renvoie un document de deux pages. Il couvre trois concurrents (Devon en a quatre), mélange des prix actuels avec des chiffres qui s’avèrent vieux d’un an, invente un prix pour un palier qu’il n’a pas trouvé, et est écrit en prose fluide qui ne tiendra pas sur une slide. Le premier réflexe de Devon est que l’agent « n’est pas assez bon » et il demande si un modèle plus capable le corrigerait.

Trace de raisonnement d’expert.

  1. Interrogez le brief avant le modèle. Chaque échec ici correspond à un élément GDCSC manquant, donc un modèle plus grand produirait les mêmes erreurs de forme plus vite. C’est un défaut de brief, pas un défaut de capacité.
  2. Défaut de but. « Assemble une synthèse concurrentielle » est une tâche, pas un résultat — il n’y a aucun énoncé de ce que l’artefact fini doit contenir, donc l’agent a choisi son propre périmètre et s’est arrêté à trois concurrents.
  3. Défaut de définition de « terminé ». Aucun test d’acceptation signifiait que rien n’a vérifié la couverture des quatre concurrents, un prix par palier, ou la tenue sur une slide. « Terminé » a été laissé au jugement de l’agent.
  4. Défaut de sources de vérité. Aucune source faisant autorité n’a été nommée, donc l’agent a mélangé librement chiffres actuels et vieux d’un an — le symptôme classique de source manquante.
  5. Défaut de gestion de l’échec. Rien n’a dit à l’agent quoi faire quand il ne trouvait pas de prix, donc il en a fabriqué un au lieu de signaler le manque.
  6. Défaut de contrainte/format. Aucune contrainte de format (« tient sur une slide, ≤ 6 puces ») signifiait qu’il a produit deux pages de prose.
  7. Le correctif. Réécrivez l’objectif avec les cinq lignes GDCSC : but = une synthèse de tarification concurrente d’une slide ; terminé = les quatre concurrents, un prix sourcé par palier, une ligne changement-depuis-le-trimestre-dernier, ≤ 6 puces, manques signalés et non comblés ; sources = la feuille de tarification partagée d’abord, puis la page publique du concurrent, signaler tout non vérifiable ; contraintes = seulement la tarification publique, jamais les conditions de deal internes ; point de contrôle = pause après le premier concurrent pour que Devon approuve le motif avant que l’agent fasse les trois autres.

Le point clé. Un modèle plus capable était le mauvais levier. La délégation a échoué parce qu’il manquait quatre de ses cinq parties au brief ; corriger le brief corrige la sortie, et le point de contrôle « un avant plusieurs » aurait saisi les problèmes de périmètre et de format après un concurrent au lieu d’après tous.

Pièges de l’évaluation

PiègePourquoi il est tentantLe discriminant
« Utilisons un modèle plus grand pour corriger un résultat erroné »La capacité semble être l’ingrédient manquantLa plupart des résultats erronés sont des défauts de brief ; corrigez d’abord l’objectif
« Le but était évident, pas besoin de définir « terminé » »Il était évident pour vousL’agent ne peut pas vérifier une définition de « terminé » qui n’existe pas
« Laissons l’agent décider le point ambigu pour gagner du temps »Biais de vitesseLes mauvaises hypothèses silencieuses coûtent plus en reprise et en risque
« Dis-lui de combler les données manquantes pour que la réponse soit complète »Les réponses d’apparence complète semblent finiesOrdonnez-lui de signaler les manques, pas de les fabriquer
« Une seule revue de fin d’exécution suffit »La revue de fin semble complètePlacez un point de contrôle avant les étapes irréversibles et avant le passage à l’échelle un→plusieurs
« Liste chaque préférence comme une exigence ferme »Tout semble importantMarquer les préférences comme contraintes fermes gaspille des efforts et bloque du bon travail

Questions d’entraînement

Chaque item indique combien de réponses sélectionner. Essayez avant de révéler.

Q1 · Quel objectif est le PLUS délégable à un agent ? (Sélectionnez une réponse)

A. « Aide avec le rapport trimestriel. » B. « Examine les chiffres de vente et vois ce qui est intéressant. » C. « Produis une synthèse d’une page indiquant quelles deux régions ont manqué leur objectif du T1 et la principale cause unique pour chacune, en citant les chiffres du rapport joint. » D. « Fais quelque chose pour les ventes faibles. »

Réponse : C. Elle énonce un résultat concret, un périmètre vérifiable et une source de vérité nommée — tout ce dont un agent a besoin pour exécuter et vous pour vérifier. A, B et D sont des souhaits, pas des objectifs : aucun ne définit ce que contient l’artefact fini ni comment vous sauriez que c’est terminé.

Q2 · Qu’est-ce qu’une « définition de terminé » pour une tâche déléguée ? (Sélectionnez une réponse)

A. Le modèle et la température à utiliser. B. Le test d’acceptation observable contre lequel vous vérifierez le résultat. C. La limite de temps de l’exécution. D. La liste des outils que l’agent peut utiliser.

Réponse : B. La définition de « terminé » est le critère vérifiable qui dit à l’agent quand s’arrêter et vous dit quoi vérifier. Les réglages du modèle (A), les limites de temps (C) et les listes d’outils (D) sont d’autres parties d’un brief mais aucune n’est le test d’acceptation.

Q3 · Un agent renvoie un travail qui semble fini mais omet silencieusement une partie de la tâche. Quel élément de brief manquait le PLUS probablement ? (Sélectionnez une réponse)

A. Un modèle plus grand. B. Une définition de « terminé » couvrant chaque partie du but. C. Une instruction de ton plus amical. D. Une limite de temps plus longue.

Réponse : B. L’omission silencieuse survient quand il n’y a pas de test d’acceptation pour vérifier la couverture, donc l’agent s’arrête quand il ressent que c’est fini. Un modèle plus grand (A) ou plus de temps (D) n’ajoute pas de vérification de complétude. Le ton (C) est sans rapport avec la couverture.

Q4 · Le brief dit « n’inclus jamais le numéro de compte complet d’un client » et « préfère les puces ». Comment l’agent devrait-il traiter cela ? (Sélectionnez une réponse)

A. Les deux sont des suggestions qu’il peut ignorer sous pression du temps. B. La règle du numéro de compte est une contrainte ferme qu’il ne doit pas violer ; la règle des puces est une préférence. C. Les deux sont des contraintes fermes. D. Les deux sont des préférences.

Réponse : B. Une règle de sécurité/confidentialité énoncée comme « jamais » est une contrainte ferme ; un « préférer » stylistique est une préférence que l’agent peut outrepasser au besoin. Traiter la règle du numéro de compte comme optionnelle (A, D) est dangereux ; traiter la préférence de puces comme ferme (C) peut bloquer un travail par ailleurs bon.

Q5 · Un agent mélange un prix actuel avec un chiffre vieux d’un an dans sa sortie. Quelle est la cause racine et le correctif LES PLUS probables ? (Sélectionnez une réponse)

A. Température trop élevée ; baissez-la. B. Aucune source de vérité nommée ; spécifiez et classez les sources faisant autorité. C. Le modèle est trop petit ; améliorez-le. D. Le prompt était trop court ; allongez-le.

Réponse : B. Mélanger données périmées et actuelles est le symptôme classique de source de vérité manquante ; le correctif est de nommer quelle source fait autorité et comment résoudre les conflits. La température (A) gouverne la variance, pas la source utilisée. La taille du modèle (C) et la longueur du prompt (D) ne disent pas à l’agent quelles données croire.

Q6 · Où le point de contrôle le plus précieux appartient-il généralement dans une tâche qui répète une action sur cinquante items ? (Sélectionnez une réponse)

A. Seulement après que les cinquante sont terminés. B. Après le premier item, pour approuver le motif avant que les quarante-neuf autres s’exécutent. C. Toutes les dix secondes quelle que soit la progression. D. Jamais ; les points de contrôle ralentissent l’agent.

Réponse : B. Le point de contrôle « un avant plusieurs » convertit une erreur en cinquante exemplaires en une erreur unique en vérifiant l’approche sur le premier item avant de passer à l’échelle. Revoir seulement à la fin (A) signifie que l’erreur s’est déjà répétée cinquante fois. Les pauses temporelles (C) ne s’alignent pas sur le risque. Aucun point de contrôle (D) supprime votre orientation.

Q7 · Un objectif est ambigu sur un point spécifique et identifiable. Quelle est la MEILLEURE instruction à l’agent ? (Sélectionnez une réponse)

A. Décide le point toi-même et continue. B. Fais une pause et demande sur ce point avant de poursuivre. C. Ignore entièrement la partie ambiguë. D. Produis deux versions complètes couvrant les deux interprétations.

Réponse : B. Une bifurcation unique identifiable se gère le mieux par un point de contrôle : faites faire une pause à l’agent et demandez avant que l’hypothèse se propage. Décider silencieusement (A) risque un mauvais chemin ; l’ignorer (C) laisse la tâche incomplète ; produire deux versions complètes (D) est gaspilleur quand une question d’une ligne la résout.

Q8 · Un agent n’a pas pu trouver un point de donnée requis, alors il a produit une valeur plausible quand même. Que le brief aurait-il dû ordonner ? (Sélectionnez une réponse)

A. De toujours combler les valeurs manquantes pour que la sortie semble complète. B. De signaler toute valeur qu’il ne peut pas vérifier plutôt que d’en fabriquer une. C. D’arrêter toute la tâche à la première valeur manquante. D. D’utiliser un modèle plus grand la prochaine fois.

Réponse : B. Une définition de « terminé » consciente de l’échec dit à l’agent de faire remonter les manques au lieu d’inventer des données, pour que vous voyiez ce qui n’est pas vérifié. Combler les manques (A) masque la fabrication. Interrompre toute la tâche (C) est disproportionné quand un manque peut être signalé. La taille du modèle (D) ne change pas le comportement de fabrication.

Q9 · Une délégation échoue. Quelle séquence reflète le diagnostic discipliné ? (Sélectionnez une réponse)

A. Améliorer le modèle, puis les outils, puis le brief. B. Interroger d’abord le brief (but, terminé, contraintes, sources, points de contrôle), puis considérer le modèle. C. Relancer le même brief plusieurs fois et moyenner les résultats. D. Supposer que la tâche est impossible.

Réponse : B. La plupart des échecs sont des défauts de brief, donc l’objectif et ses cinq éléments sont la première chose à vérifier avant de toucher au modèle. Les changements de modèle/outils d’abord (A) gaspillent des efforts sur la mauvaise cause. Relancer le même brief (C) reproduit le même défaut. Déclarer l’impossibilité (D) saute le diagnostic.

Q10 · Quelle paire appartient à une définition de « terminé » forte pour une synthèse prête pour slide ? (Sélectionnez deux réponses)

A. Couvre les quatre concurrents nommés. B. Utilise le modèle le plus récent disponible. C. Tient sur une slide avec au plus six puces. D. S’exécute en moins de cinq minutes. E. Utilise un ton chaleureux et amical de bout en bout.

Réponse : A et C. La couverture des quatre concurrents (A) et une borne de taille d’une slide / six puces (C) sont des critères d’acceptation observables que vous pouvez cocher. Le choix du modèle (B) et la durée d’exécution (D) sont opérationnels, pas des tests d’acceptation. Le ton (E) est une préférence, pas un critère de « terminé » pour une synthèse de données.

Q11 · Un manager délègue « améliore nos docs d’onboarding » sans autre détail. Quelle est la PREMIÈRE chose à corriger avant qu’un agent s’exécute ? (Sélectionnez une réponse)

A. Choisir un modèle plus rapide. B. Transformer le but vague en un résultat concret et vérifiable avec une définition de « terminé ». C. Accorder à l’agent l’accès à tous les connectors disponibles. D. Fixer la limite de temps à une heure.

Réponse : B. « Améliore » est un souhait sans résultat ni test d’acceptation, donc le premier correctif est de spécifier ce que « amélioré » signifie et comment vous le vérifierez. La vitesse du modèle (A) et les limites de temps (D) ne définissent pas le résultat. Un large accès (C) ajoute du rayon d’impact sans clarifier le but.

Q12 · Quand plusieurs sources donnent des chiffres contradictoires, que le brief devrait-il fournir ? (Sélectionnez une réponse)

A. Rien — laisser l’agent les moyenner. B. Un ordre classé de résolution des conflits indiquant quelle source l’emporte et quand signaler l’incertitude. C. Des instructions pour toujours faire confiance au web public. D. Une fenêtre de contexte plus grande.

Réponse : B. Classer les sources et dire à l’agent quand signaler l’incertitude est la façon de garder la sortie ancrée quand les données divergent. Moyenner (A) mélange bonnes et mauvaises données. Toujours faire confiance au web (C) est souvent le choix le moins faisant autorité. Une fenêtre de contexte plus grande (D) ne résout pas quelle source croire.

Q13 · Un chef de projet veut qu’un agent migre la mise en forme de 120 documents. Il écrit un résultat clair et une définition de « terminé » mais aucun point de contrôle. Quels DEUX points de contrôle ajoutent le plus de sécurité ? (Sélectionnez deux réponses)

A. Faire une pause après le premier document pour que le motif puisse être approuvé avant que le reste s’exécute. B. Faire une pause après chaque document individuel pour approbation. C. Faire une pause avant toute étape qui écraserait un fichier original de façon irréversible. D. Faire une pause toutes les trente secondes quelle que soit la progression. E. Ne jamais faire de pause, pour finir plus vite.

Réponse : A et C. Approuver le motif sur le premier document (A) prévient une erreur en 120 exemplaires, et encadrer les écrasements irréversibles (C) protège les originaux. Faire une pause à chaque document (B) annule l’intérêt de déléguer. Les pauses temporelles (D) ne s’alignent pas sur le risque. Aucune pause (E) supprime toute orientation sur une action de masse irréversible.

Q14 · Quel énoncé capture le mieux pourquoi « aller vite, laisser l’agent supposer » est un mauvais choix par défaut pour un objectif ambigu ? (Sélectionnez une réponse)

A. C’est toujours plus lent en pratique. B. La vitesse achetée par une mauvaise hypothèse non énoncée se rembourse en reprise, et pire si l’hypothèse a conduit à une action irréversible. C. Les agents ne peuvent pas du tout faire d’hypothèses. D. Cela utilise plus de tokens que demander.

Réponse : B. Une mauvaise hypothèse non remontée s’aggrave en reprise et, sur une étape irréversible, en dommage irrécupérable — donc la vitesse apparente est une fausse économie. Ce n’est pas toujours littéralement plus lent au départ (A). Les agents peuvent faire des hypothèses (C). L’usage de tokens (D) n’est pas le risque substantiel.

À retenir

  • Un objectif délégable a cinq parties — But, Terminé, Contraintes, Sources, Points de contrôle (GDCSC) ; une ligne vide est là où la délégation échouera.
  • Énoncez le résultat, pas les frappes clavier ; les étapes contraignent l’agent et masquent le test d’acceptation.
  • La définition de « terminé » est une checklist observable, bornée et consciente de l’échec — elle dit à l’agent quand s’arrêter et à vous quoi vérifier.
  • Distinguez les contraintes fermes (must/never) des préférences ; les agents doivent savoir lesquelles ils peuvent outrepasser.
  • Nommez et classez les sources de vérité ; des données périmées et actuelles mélangées sont un symptôme de source manquante, pas un problème de modèle.
  • Placez les points de contrôle là où le risque est le plus élevé — avant les étapes irréversibles et avant de passer à l’échelle d’un item à plusieurs.
  • Gérez l’ambiguïté en la résolvant, en disant à l’agent de faire une pause et de demander, ou en lui faisant remonter les hypothèses — jamais en le laissant deviner silencieusement.
  • Diagnostiquez une délégation ratée comme un défaut de brief d’abord ; un modèle plus grand corrige rarement un objectif vague.

Dernière mise à jour le 18 sept. 2026