AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Agents and Workflows

Agents – Examen blanc 2

Un examen blanc indépendant plus difficile de 50 items, pondéré par domaine, pour la piste Agents and Workflows, conçu comme un test de préparation chronométré.

Ceci est le second examen blanc indépendant complet pour la piste Agents and Workflows, construit à partir des objectifs d’apprentissage OpenAI accessibles au public et n’est pas une évaluation officielle OpenAI. Il est délibérément plus difficile que l’examen blanc 1 — plus d’énoncés à contraintes multiples et plus de qualificatifs FIRST / BEST / MOST cost-effective / TWO. Les 50 questions sont inédites et distinctes de l’examen blanc 1 comme des items des pages de domaine. Utilisez-le comme test de préparation en conditions chronométrées une fois l’examen blanc 1 et votre révision derrière vous.

Consignes

  • Durée : 60 minutes. Passez celui-ci chronométré, en un seul bloc ininterrompu.
  • Items : 50 questions à choix multiple et à réponses multiples. Chaque item indique combien de réponses sélectionner.
  • Sélection : pour un item à réponses multiples, vous devez sélectionner toutes les bonnes options et aucune mauvaise pour obtenir le point ; il n’y a pas de crédit partiel.
  • Aucune pénalité pour les mauvaises réponses : répondez à chaque question — une mauvaise réponse ne coûte rien au-delà du point.
  • Objectif : visez au moins 80 % brut (40 sur 50) en conditions chronométrées avant de passer la véritable évaluation Academy Agents and Workflows. La barre des 80 % correspond au seuil du badge Academy.
  • Lisez attentivement les énoncés à contraintes multiples : le qualificatif (FIRST, BEST, TWO) départage généralement deux options défendables.

Répartition par domaine

#DomainePondérationItems ici
1What an Agent Is and When to Use One16 %8
2Defining Objectives and Tasks18 %9
3Context, Tools and Permissions18 %9
4Boundaries and Guardrails16 %8
5Reviewing and Verifying Agent Work16 %8
6Reliability and Iteration16 %8

Total : 8 + 9 + 9 + 8 + 8 + 8 = 50 items.

Interprétation de la préparation

Ceci est un indicateur de préparation indépendant, pas un score officiel.

Score brut (sur 50)PalierInterprétation
45–5090 %+Forte préparation ; vous êtes prêt pour la véritable évaluation
40–4480–89 %Prêt pour l’évaluation ; revoyez tout domaine faible
35–3970–79 %Confiance en construction ; une autre passe de révision conseillée
Moins de 35moins de 70 %Continuez à apprendre ; cette série plus difficile a révélé de vrais écarts

Comme cet examen blanc est plus difficile que l’examen blanc 1, un score dans le palier 80–89 % ici est un signal fort de préparation. Traitez 40 sur 50 comme votre seuil minimal.

Passer l’examen blanc

Deux façons d’utiliser les questions ci-dessous : le mode interactif lance une session chronométrée, une question à la fois, et se termine par votre indicateur de préparation, une ventilation par domaine et une correction complète ; le mode révision en dessous liste chaque question avec ses options une par ligne et la réponse masquée jusqu’à ce que vous la demandiez.

Mode interactif

Passer l’examen d’entraînement

50 questions · une à la fois · compte à rebours de 60 minutes · résultats avec répartition par domaine et correction complète à la fin. Votre progression est enregistrée dans ce navigateur si vous quittez la page.

Toutes les questions (mode révision)

Les options sont présentées une par ligne. La réponse et l’explication restent masquées jusqu’à ce que vous cliquiez sur Afficher la réponse. Utilisez le mode interactif ci-dessus pour une session chronométrée.

  1. Q1D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un chef d’équipe a une tâche dont les étapes sont entièrement connues et identiques à chaque exécution, mais qui touche un envoi externe irréversible. En considérant ensemble le chemin, l’accès, la durée et la réversibilité, quelle construction est la plus appropriée ?

    • A. Un agent avec envoi autonome, parce que l’envoi est la partie fastidieuse
    • B. Un workflow avec un point de contrôle d’approbation humaine avant l’envoi
    • C. Un simple prompt qui fait tout d’un coup
    • D. Un agent avec de larges connectors pour qu’il ne se bloque jamais
    Afficher la réponse

    Réponse : B.

    Un chemin fixe et connu oriente vers un workflow plutôt qu’un agent, et l’envoi irréversible doit se situer derrière un verrou humain. L’envoi autonome (A) supprime le seul contrôle qui compte, un simple prompt (C) ne peut pas porter un processus séquencé, et un agent à large accès (D) ajoute une autonomie dont le chemin fixe n’a pas besoin plus un rayon d’impact inutile.

  2. Q2D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Deux tâches semblent de difficulté comparable. La tâche X a des étapes qui dépendent de ce que les étapes précédentes trouvent et s’exécute sans surveillance ; la tâche Y a une séquence fixe que vous vérifiez entre les étapes. Quel est le meilleur classement ?

    • A. Les deux sont des agents, parce que les deux sont difficiles
    • B. X est un agent et Y est un workflow, parce que l’axe décisif est de savoir si le chemin peut être scripté, et non la difficulté
    • C. Les deux sont des prompts, parce que chacune pourrait commencer par une seule requête
    • D. X est un workflow et Y est un agent
    Afficher la réponse

    Réponse : B.

    L’adéquation se décide selon que le chemin est connu d’avance : X doit planifier (agent), Y est fixe avec des relectures (workflow). Traiter la difficulté comme décisive (A) est le piège, considérer les deux comme des prompts (C) ignore leur nature multi-étapes, et D inverse la bonne correspondance.

  3. Q3D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un manager veut automatiser de bout en bout une tâche récurrente, y compris une étape de publication publique, en arguant que c’est la partie la plus fastidieuse. Quelle est la PREMIÈRE chose que vous devez établir ?

    • A. Quel modèle est le moins cher pour la tâche
    • B. Si la publication irréversible peut être placée derrière un point de contrôle d’approbation ; si elle ne le peut pas, l’étape dangereuse ne devrait pas être automatisée
    • C. Combien de mots le brief devrait contenir
    • D. Si un concurrent utilise des agents pour cela
    Afficher la réponse

    Réponse : B.

    La réversibilité gouverne la sûreté de l’automatisation : une étape irréversible qui ne peut pas être verrouillée est un signal de ne pas automatiser cette étape. Le coût du modèle (A) et la longueur du brief (C) sont secondaires, et ce que fait un concurrent (D) est sans rapport avec la possibilité de déléguer cette action en toute sécurité.

  4. Q4D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Une partie prenante insiste sur le fait que, parce qu’une tâche prendra vingt minutes non surveillées à un agent, elle doit être « plus puissante » qu’un prompt de deux minutes. Quelle est la correction la plus exacte ?

    • A. Elle a raison ; les exécutions plus longues sont toujours plus performantes
    • B. La durée change la supervision, pas la puissance : une exécution non surveillée plus longue signifie que vous devez concevoir des limites et une vérification, car vous ne pouvez pas la corriger en direct
    • C. La durée n’est purement qu’une question de coût, sans implications de supervision
    • D. Un prompt de deux minutes ne peut pas produire de travail utile
    Afficher la réponse

    Réponse : B.

    La durée est un axe de supervision : les exécutions non surveillées plus longues déplacent le contrôle de l’observation en direct vers des limites conçues et une vérification a posteriori. Elle n’équivaut pas à la puissance (A), elle dépasse une question de coût (C), et les courts prompts produisent couramment un travail utile (D).

  5. Q5D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Une tâche est réellement multi-étapes et tire parti d’outils, mais vous ne pouvez pas énoncer à quoi ressemble un résultat achevé et correct. Qu’est-ce que cela implique le plus fortement ?

    • A. Déléguez-la quand même à un agent ; il en déduira le succès
    • B. Elle n’est pas encore délégable — la définition de « terminé » manquante doit être résolue avant qu’un agent ne s’exécute, quelle que soit son apparente compatibilité avec les outils
    • C. Utilisez le plus grand modèle pour compenser le flou
    • D. Accordez tous les outils pour qu’il ait plus de moyens de réussir
    Afficher la réponse

    Réponse : B.

    Sans définition de « terminé », vous ne pouvez ni briefer ni vérifier le travail, si bien que le caractère multi-étapes et compatible avec les outils ne le rend pas encore délégable. Déléguer malgré tout (A) produit une sortie invérifiable, et un modèle plus grand (C) ou davantage d’outils (D) ne peuvent pas remplacer un test d’acceptation manquant.

  6. Q6D1 · Ce qu’est un agent et quand en utiliser unSélectionnez deux réponses

    Un travailleur du savoir évalue un agent pour l’assemblage trimestriel d’un dossier de conseil d’administration. Quels DEUX facteurs plaident le plus fortement CONTRE un agent et POUR un workflow avec verrous ?

    • A. Les étapes d’assemblage sont les mêmes chaque trimestre et entièrement documentées
    • B. La diffusion finale au conseil est irréversible et externe
    • C. La tâche est longue et implique plusieurs documents
    • D. Le demandeur trouve la tâche ennuyeuse
    • E. La sortie n’est jamais qu’un brouillon privé
    Afficher la réponse

    Réponse : A et B.

    Un chemin fixe et documenté (A) rend un workflow moins coûteux et plus vérifiable qu’un agent, et la diffusion externe irréversible (B) exige un verrou plutôt que de l’autonomie. La longueur et les multiples documents (C) n’exigent pas à eux seuls un agent, l’ennui (D) est sans rapport, et un brouillon privé (E) abaisserait le risque plutôt que de plaider contre un agent.

  7. Q7D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Quel raisonnement distingue le MIEUX un agent d’un prompt très long et très détaillé ?

    • A. Le prompt est plus long, donc il a plus d’autonomie
    • B. Dans le prompt, vous décidez encore de chaque étape suivante ; l’agent choisit ses propres étapes vers un objectif, donc l’autonomie — pas la longueur — est le séparateur
    • C. L’agent utilise toujours des modèles plus chers
    • D. Un long prompt ne peut inclure aucune contrainte
    Afficher la réponse

    Réponse : B.

    L’autonomie, c’est qui choisit l’étape suivante : un long prompt reste à faible autonomie si vous le pilotez, alors qu’un agent planifie lui-même le chemin. La longueur ne confère pas l’autonomie (A), le coût du modèle (C) est sans rapport, et les prompts peuvent tout à fait inclure des contraintes (D).

  8. Q8D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Une tâche manuelle de cinq minutes nécessiterait une heure de mise en place et de vérification à chaque exécution en tant qu’agent. En appliquant l’angle réversibilité-et-coût, quelle est la MEILLEURE décision ?

    • A. L’automatiser ; l’automatisation en vaut toujours la peine à terme
    • B. Ne pas déléguer : lorsque vérifier la sortie non surveillée coûte plus que le travail, la délégation est une perte nette
    • C. Déléguer mais sauter la vérification pour économiser l’heure
    • D. Utiliser deux agents en parallèle par sécurité
    Afficher la réponse

    Réponse : B.

    Lorsque contrôler la sortie coûte plus que de simplement faire la tâche, un agent est une perte nette — un signal fondamental de « mauvais outil ». Automatiser quand même (A) ignore le coût, sauter la vérification (C) échange une petite économie contre un risque non borné, et un second agent (D) augmente à la fois le coût et la charge de vérification.

  9. Q9D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un agent a renvoyé un rapport qui a fait quelque chose d’adjacent à ce qui était voulu, a silencieusement supprimé une section et a cité un chiffre périmé. En appliquant la discipline « brief d’abord », quel changement unique devriez-vous faire en PREMIER ?

    • A. Passer au modèle le plus performant
    • B. Interroger et réparer le brief — reformuler le résultat, ajouter une définition de « terminé » complète en couverture et nommer la source de vérité — avant de toucher au modèle
    • C. Relancer plusieurs fois le brief identique et faire la moyenne des sorties
    • D. Accorder un large accès aux connectors pour réduire les blocages futurs
    Afficher la réponse

    Réponse : B.

    Les trois symptômes renvoient à des défauts de brief — un objectif en forme de tâche, une définition de « terminé » manquante et une source non nommée — donc la première démarche disciplinée est de réparer le brief. Un modèle plus grand (A) reproduit les mêmes erreurs de forme, relancer le même brief (C) reproduit le défaut, et un large accès (D) ne traite aucune de ces causes.

  10. Q10D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Plusieurs sources fournies donnent des chiffres de chiffre d’affaires contradictoires. Que doit fournir un brief bien formé pour que l’agent reste ancré ?

    • A. Rien — laissez l’agent faire la moyenne des nombres
    • B. Un ordre hiérarchisé de résolution des conflits indiquant quelle source l’emporte et quand signaler l’incertitude restante
    • C. Une instruction de toujours faire confiance au web public
    • D. Une fenêtre de contexte plus grande
    Afficher la réponse

    Réponse : B.

    Hiérarchiser les sources et indiquer à l’agent quand signaler l’incertitude maintient la sortie ancrée quand les données divergent. Faire la moyenne (A) mélange bonnes et mauvaises données, toujours faire confiance au web (C) est souvent le choix le moins faisant autorité, et une fenêtre plus grande (D) ne résout pas quelle source croire.

  11. Q11D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un brief pour un traitement en masse de plus de 200 éléments a un résultat clair et une définition de « terminé », mais aucun point de contrôle. Quel point de contrôle UNIQUE ajoute le PLUS de sécurité pour le moindre coût de relecture ?

    • A. Faire une pause après chaque élément pour une approbation individuelle
    • B. Faire une pause après le premier élément afin que le schéma puisse être approuvé avant l’exécution des éléments restants
    • C. Faire une pause toutes les trente secondes, quel que soit l’avancement
    • D. Ne jamais faire de pause, pour terminer plus vite
    Afficher la réponse

    Réponse : B.

    Le point de contrôle « un avant plusieurs » empêche une erreur en 200 exemplaires au prix d’une seule relecture. Faire une pause à chaque élément (A) contrarie l’intérêt de déléguer, les pauses temporelles (C) ne s’alignent pas sur le risque, et l’absence de pause (D) supprime tout pilotage sur une action en masse.

  12. Q12D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un manager a écrit dans un brief « privilégiez un style concis », « ne partagez jamais de données financières provisoires en externe » et « visez à terminer aujourd’hui ». Laquelle est la PLUS importante à faire passer d’une formulation à un contrôle imposé, et pourquoi ?

    • A. « Privilégiez un style concis », parce que le ton compte le plus pour les lecteurs
    • B. « Ne partagez jamais de données financières provisoires en externe », parce que c’est une contrainte stricte dont la violation est irréversible et sensible
    • C. « Visez à terminer aujourd’hui », parce que les délais sont la priorité
    • D. Aucune ; les trois sont des préférences égales
    Afficher la réponse

    Réponse : B.

    La règle de confidentialité est une contrainte stricte protégeant une divulgation irréversible et sensible, elle mérite donc une imposition système plutôt qu’une simple formulation. Le style (A) et le souhait de calendrier (C) sont des préférences, et traiter les trois comme égales (D) manque le fait qu’une seule protège contre un préjudice réel et difficile à annuler.

  13. Q13D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Quel objectif est le MIEUX écrit comme un résultat délégable plutôt qu’une liste de tâches ?

    • A. Ouvrez chaque dossier, lisez les notes, puis réfléchissez à ce qu’il faut écrire
    • B. Produisez une checklist d’onboarding d’une page couvrant les cinq étapes requises, sourcée sur la politique RH en vigueur, avec toute lacune signalée
    • C. Passez tout en revue et améliorez-le
    • D. Faites le truc d’onboarding habituel que vous faites toujours
    Afficher la réponse

    Réponse : B.

    L’option B nomme un artefact concret, un périmètre borné, une source faisant autorité et un comportement en cas d’échec, elle est donc à la fois exécutable et vérifiable. A décrit des frappes clavier plutôt qu’un résultat, et C et D sont des souhaits vagues sans test d’acceptation.

  14. Q14D2 · Définir les objectifs et les tâchesSélectionnez deux réponses

    Un chef de projet délègue la migration de la mise en forme de 150 documents avec un résultat clair et une définition de « terminé ». Quels DEUX points de contrôle ajoutent le PLUS de sécurité ?

    • A. Faire une pause après le premier document afin que le schéma puisse être approuvé avant l’exécution du reste
    • B. Faire une pause avant toute étape qui écraserait irréversiblement un fichier original
    • C. Faire une pause après chaque document pour une approbation individuelle
    • D. Faire une pause chaque minute, quel que soit l’avancement
    • E. Ne jamais faire de pause, pour terminer plus vite
    Afficher la réponse

    Réponse : A et B.

    Approuver le schéma sur le premier document (A) empêche une erreur en 150 exemplaires, et verrouiller les écrasements irréversibles (B) protège les originaux. Faire une pause à chaque document (C) contrarie la délégation, les pauses temporelles (D) ne s’alignent pas sur le risque, et l’absence de pause (E) supprime tout pilotage sur une action irréversible en masse.

  15. Q15D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un objectif contient de nombreuses petites inconnues que vous ne pouvez pas pré-résoudre et il n’y a pas de bifurcation unique à verrouiller. Quelle est la MEILLEURE instruction à donner à l’agent ?

    • A. Choisir en silence des interprétations et poursuivre rapidement
    • B. Énoncer les hypothèses qu’il pose et les faire remonter pour relecture, afin que les mauvaises puissent être détectées
    • C. Refuser la tâche jusqu’à ce que chaque inconnue soit levée
    • D. Produire une version complète distincte pour chaque interprétation possible
    Afficher la réponse

    Réponse : B.

    Lorsqu’il y a de nombreuses petites inconnues et aucune bifurcation unique où faire une pause, la meilleure démarche est de faire remonter par l’agent ses hypothèses pour relecture. Les choix silencieux (A) masquent les mauvais virages, refuser d’emblée (C) est disproportionné, et énumérer chaque version complète (D) est du gaspillage et peu pratique.

  16. Q16D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un brief dit « résumez l’incident » sans périmètre. L’agent renvoie une note de deux lignes alors que la direction attendait une chronologie complète. Qu’est-ce que cela révèle le PLUS directement à propos du brief ?

    • A. Le modèle est trop petit
    • B. La définition de « terminé » manquait de périmètre, si bien que l’agent a choisi le sien et s’est arrêté tôt
    • C. Le niveau de raisonnement était trop bas
    • D. L’agent manquait d’accès aux connectors
    Afficher la réponse

    Réponse : B.

    Sans périmètre dans la définition de « terminé », l’agent a fixé sa propre borne et s’est arrêté, produisant moins qu’attendu. La taille du modèle (A) et le niveau de raisonnement (C) ne définissent pas le périmètre, et une lacune d’accès (D) se manifesterait par un blocage ou des données erronées, pas par une synthèse sous-dimensionnée.

  17. Q17D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Quel énoncé explique le MIEUX pourquoi « avancer vite, laisser l’agent supposer » est un mauvais défaut pour un objectif ambigu ?

    • A. C’est toujours littéralement plus lent au départ
    • B. La vitesse achetée par une hypothèse erronée non énoncée se paie en reprises, et pire encore si cette hypothèse a piloté une action irréversible
    • C. Les agents sont incapables de poser la moindre hypothèse
    • D. Cela utilise simplement plus de tokens que de demander
    Afficher la réponse

    Réponse : B.

    Une hypothèse erronée non remontée s’aggrave en reprises et, sur une étape irréversible, en préjudice irrécupérable, si bien que la vitesse apparente est une fausse économie. Ce n’est pas toujours plus lent au départ (A), les agents peuvent poser des hypothèses (C), et l’usage des tokens (D) n’est pas le risque de fond.

  18. Q18D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent rédigeant des e-mails de renouvellement a cité une politique obsolète ET a extrait des détails des fichiers de clients sans rapport. Quelle paire de correctifs traite les DEUX causes distinctes ?

    • A. Fournir la politique en vigueur comme source faisant autorité, et restreindre le connector aux seuls enregistrements de compte pertinents
    • B. Passer à un modèle plus grand, et supprimer tous les points de contrôle pour accélérer l’exécution
    • C. Accorder un accès en écriture à chaque compte, et coller davantage de documents
    • D. Baisser le niveau de raisonnement, et activer l’envoi autonome
    Afficher la réponse

    Réponse : A.

    La politique obsolète est une lacune de contexte corrigée en fournissant la politique en vigueur, tandis que la fuite entre comptes est un problème d’accès/de portée corrigé en restreignant le connector. Un modèle plus grand (B) ne corrige aucune cause, un large accès en écriture et davantage de documents (C) aggravent le risque et manquent le correctif de contexte, et baisser l’effort avec l’envoi autonome (D) ne traite ni l’un ni l’autre et ajoute du danger.

  19. Q19D3 · Contexte, outils et permissionsSélectionnez deux réponses

    En appliquant l’échelle lecture puis écriture puis envoi pour le moindre privilège, quelles DEUX postures sont des défauts corrects ?

    • A. Commencer par la lecture et n’accorder l’écriture que si la tâche doit modifier des données
    • B. Maintenir l’envoi verrouillé derrière une approbation humaine chaque fois qu’il est activé
    • C. Commencer par l’envoi et ne retirer l’accès que si des problèmes apparaissent
    • D. Accorder l’écriture par défaut parce que la plupart des tâches en ont besoin
    • E. Accorder l’envoi tout en retenant la lecture, pour limiter l’exposition
    Afficher la réponse

    Réponse : A et B.

    L’échelle sûre commence par la lecture et n’ajoute l’écriture que pour modifier des données (A), et verrouille toujours l’envoi (B). Commencer par l’envoi (C) expose d’abord des actions irréversibles, l’écriture par défaut (D) sur-dote, et l’envoi-sans-lecture (E) est incohérent car l’agent pourrait agir sans ancrer son action.

  20. Q20D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un chef d’équipe veut élargir l’accès d’un agent après qu’il s’est réellement bloqué sur une vraie tâche faute de portée. Quand l’élargissement est-il justifié dans le cadre du moindre privilège ?

    • A. Jamais ; l’accès devrait rester fixe pour toujours
    • B. Lorsqu’une exécution réelle démontre un besoin authentique, accordé aussi étroitement que possible
    • C. Chaque fois que ce serait commode
    • D. Seulement pour le personnel senior, quelle que soit la tâche
    Afficher la réponse

    Réponse : B.

    Le moindre privilège s’élargit sur preuve : une exécution réelle montrant un besoin authentique justifie l’octroi additionnel le plus étroit qui débloque. Un accès figé pour toujours (A) ignore les besoins réels, la commodité (C) est le piège du sur-dimensionnement, et l’ancienneté (D) n’est pas la base d’un accès délimité à la tâche.

  21. Q21D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent produit un travail compétent mais ignore systématiquement une décision que l’équipe a déjà prise, tout en ne signalant aucun problème d’accès. Quelle est la cause la PLUS probable et le correctif ?

    • A. Accès manquant ; accordez davantage de connectors
    • B. Contexte de décisions antérieures manquant ; fournissez le compte rendu de ce qui a déjà été tranché
    • C. Un défaut du modèle ; passez à un modèle supérieur
    • D. Trop peu de niveau de raisonnement ; augmentez-le
    Afficher la réponse

    Réponse : B.

    Ignorer une décision tranchée sans plainte d’accès est une lacune de contexte de décisions antérieures, corrigée en fournissant ce compte rendu. Accorder des connectors (A) traite l’accès, qui n’est pas le problème, et un modèle plus grand (C) ou plus d’effort (D) ne feront pas remonter une décision qui ne lui a jamais été donnée.

  22. Q22D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un workspace agent reçoit un connector vers un canal pour répondre à une seule question sur un fil récent. Quelle est la question CLÉ à poser avant de l’activer ?

    • A. Quelle police la réponse doit utiliser
    • B. Si la tâche a besoin de tout l’historique du canal, ou si le connector peut être restreint plus étroitement
    • C. Combien de tokens la réponse consommera
    • D. Si l’agent préfère ce canal
    Afficher la réponse

    Réponse : B.

    Un connector de canal expose tout l’historique, si bien que la question clé de moindre privilège est de savoir si la tâche a réellement besoin de cette portée ou peut être restreinte plus étroitement. La police (A), le nombre de tokens (C) et une préférence imaginaire (D) sont sans rapport avec la portée que le connector accorde.

  23. Q23D3 · Contexte, outils et permissionsSélectionnez deux réponses

    La sortie d’un agent est compétente mais générique, et il s’est aussi arrêté prématurément en disant qu’il « ne pouvait pas atteindre le système de tarification ». Quels DEUX correctifs traitent correctement les DEUX problèmes distincts ?

    • A. Fournir le contexte de marque et de produit qui lui manque
    • B. Accorder un connector en lecture au périmètre restreint au système de tarification
    • C. Passer à un modèle plus grand pour couvrir les deux problèmes d’un coup
    • D. Coller tous les documents que vous avez dans la tâche
    • E. Activer l’envoi autonome pour qu’il puisse terminer
    Afficher la réponse

    Réponse : A et B.

    Une sortie générique est un problème de contexte manquant corrigé en fournissant le contexte de marque et de produit (A), tandis que « ne pouvait pas atteindre » est un problème d’accès manquant corrigé par un connector restreint (B). Un modèle plus grand (C) ne traite ni l’un ni l’autre, tout coller (D) noie le signal, et l’envoi autonome (E) est sans rapport et risqué.

  24. Q24D3 · Contexte, outils et permissionsSélectionnez une réponse

    Pourquoi « par sécurité, connectez l’agent à tout ce dont il pourrait éventuellement avoir besoin » est-il le MAUVAIS défaut ?

    • A. C’est correct ; un large accès n’a aucun inconvénient
    • B. Un large accès est un large rayon d’impact et une large portée ; un agent autonome peut en utiliser n’importe quelle partie, donc vous commencez minimal et élargissez sur preuve
    • C. Cela rend toujours l’agent plus lent
    • D. Cela force l’agent sur un modèle plus petit
    Afficher la réponse

    Réponse : B.

    Chaque connector ajouté est une portée ajoutée qu’un agent autonome peut exercer, si bien que le moindre privilège commence minimal et n’élargit que sur besoin démontré. Un large accès a de réels inconvénients (A), et il ne dicte ni la vitesse (C) ni la taille du modèle (D).

  25. Q25D3 · Contexte, outils et permissionsSélectionnez une réponse

    Une tâche nécessite que l’agent lise dans deux systèmes internes et produise un brouillon que vous enverrez. Quel provisionnement est le PLUS aligné sur le moindre privilège ?

    • A. Un accès en écriture aux deux systèmes plus l’envoi autonome
    • B. Des connectors en lecture restreints aux enregistrements précis des deux systèmes, plus la création de brouillon avec l’envoi verrouillé derrière votre approbation
    • C. Un unique large connector vers tout le lecteur de l’entreprise
    • D. Aucun connector ; qu’il devine de mémoire
    Afficher la réponse

    Réponse : B.

    La lecture restreinte aux seuls enregistrements nécessaires, la création de brouillon et un envoi verrouillé constituent l’ensemble minimal qui permet à la tâche de réussir en toute sécurité. L’écriture plus l’envoi autonome (A) sur-dote et supprime le verrou d’envoi, un large connector de lecteur (C) accorde une portée excessive, et l’absence de connectors (D) force à deviner.

  26. Q26D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent a cité une note interne sur les marges dans un brouillon destiné au client. Quelle est la cause RACINE et le correctif le plus fort ?

    • A. Il a halluciné la note ; baissez le niveau de raisonnement
    • B. Il avait la portée d’atteindre des données internes auxquelles il n’aurait jamais dû accéder ; restreignez son accès pour que la note soit inatteignable
    • C. La définition de « terminé » était trop stricte ; assouplissez-la
    • D. La fenêtre de contexte était trop petite ; agrandissez-la
    Afficher la réponse

    Réponse : B.

    L’agent a pu citer la note parce qu’il en avait la portée — une défaillance de sur-dimensionnement dont le correctif le plus fort est de rendre les données internes inatteignables. Il n’a pas halluciné une note réelle à laquelle il avait accès (A), et une définition de « terminé » stricte (C) ou la taille de la fenêtre (D) sont sans rapport avec la fuite.

  27. Q27D4 · Limites et garde-fousSélectionnez une réponse

    Un agent a envoyé un e-mail à plusieurs nouveaux contacts externes malgré un brief disant « ne contactez jamais personne de nouveau sans vérifier ». Quel est le bon correctif ?

    • A. Reformuler l’instruction dans un langage plus fort
    • B. Déplacer la limite dans le système : imposer un point de contrôle d’approbation pour qu’il ne puisse pas envoyer à un nouveau contact sans autorisation
    • C. Utiliser un modèle plus grand qui suit mieux les instructions
    • D. Supprimer la définition de « terminé » pour simplifier l’exécution
    Afficher la réponse

    Réponse : B.

    La défaillance est une limite respectée sur une action irréversible ; le correctif consiste à l’imposer comme un point de contrôle d’approbation au niveau système. Une formulation plus ferme (A) reste une simple limite respectée, un modèle plus grand (C) peut toujours mal lire, et supprimer la définition de « terminé » (D) est sans rapport et nuisible.

  28. Q28D4 · Limites et garde-fousSélectionnez une réponse

    Un manager doit borner le pire cas d’une exécution d’agent nocturne sur une file d’attente non bornée. Quel contrôle UNIQUE garantit le plus directement que l’exécution ne peut pas traiter plus d’un nombre connu d’éléments ?

    • A. Une note dans le brief lui demandant d’être efficace
    • B. Un plafond de périmètre imposé sur le nombre d’éléments traités
    • C. Un réglage de ton plus amical
    • D. Supprimer tous les points de contrôle pour qu’il termine plus vite
    Afficher la réponse

    Réponse : B.

    Un plafond de périmètre imposé limite directement le nombre d’éléments que l’exécution peut toucher, bornant le pire cas. Une note polie (A) est une limite respectée qui n’arrêtera pas un emballement, le ton (C) est sans rapport, et supprimer les points de contrôle (D) augmente le risque.

  29. Q29D4 · Limites et garde-fousSélectionnez une réponse

    Quelle description correspond au point de contrôle d’approbation le MIEUX conçu pour un envoi externe irréversible ?

    • A. Il fait une pause après l’envoi, pour que l’agent ne soit pas ralenti
    • B. Il fait une pause avant l’envoi et fait remonter le brouillon complet et les destinataires afin que l’humain puisse décider rapidement
    • C. Il demande « continuer ? » sans aucun détail
    • D. Il verrouille chaque étape à parts égales pour maximiser la sécurité
    Afficher la réponse

    Réponse : B.

    Un bon verrou fait une pause avant l’étape irréversible et montre assez de contexte — le brouillon et les destinataires — pour une décision réelle et peu coûteuse. Faire une pause après (A) ne contrôle rien, une invite sans détail (C) invite à une approbation aveugle, et verrouiller chaque étape (D) provoque une fatigue de validation automatique.

  30. Q30D4 · Limites et garde-fousSélectionnez une réponse

    Un agent « examinant les demandes de partenariat » a interprété largement « oui clair » et a écrit à des entreprises avec lesquelles il n’avait jamais traité, un message citant des conditions internes. Quelle combinaison de correctifs est la PLUS complète ?

    • A. Reformuler « oui clair » plus précisément et faire confiance à l’agent
    • B. Imposer un point de contrôle d’approbation sur tous les envois externes, exiger une validation explicite pour les nouveaux contacts et retirer la portée vers les conditions internes
    • C. Utiliser le modèle le plus performant et activer l’envoi autonome
    • D. Ajouter un plafond de dépense et rien d’autre
    Afficher la réponse

    Réponse : B.

    Les deux préjudices provenaient de limites respectées sur des actions irréversibles/sensibles, donc le correctif complet impose le verrou d’envoi, ajoute un verrou à plus fort enjeu pour les nouveaux contacts et retire la portée vers les conditions internes. Reformuler et faire confiance (A) laisse une limite respectée, un modèle plus grand avec envoi autonome (C) supprime le contrôle, et un plafond de dépense seul (D) ne traite ni l’envoi ni la fuite.

  31. Q31D4 · Limites et garde-fousSélectionnez une réponse

    Pour un brouillon interne à faible enjeu que vous lirez avant d’en faire quoi que ce soit, quelle posture de limite est la PLUS appropriée ?

    • A. Des verrous imposés lourds sur chaque étape
    • B. Une relecture légère après l’exécution, sans verrou, parce que rien d’irréversible ne se produit
    • C. Un plafond de dépense de zéro pour qu’il ne puisse pas s’exécuter du tout
    • D. Désactiver tous les outils
    Afficher la réponse

    Réponse : B.

    Les limites doivent correspondre aux enjeux : un brouillon interne réversible que vous relirez ne nécessite qu’une relecture légère. Des verrous lourds (A) gaspillent l’attention, un plafond de zéro (C) bloque la tâche, et désactiver tous les outils (D) empêche un travail inoffensif.

  32. Q32D4 · Limites et garde-fousSélectionnez deux réponses

    Quels DEUX contrôles doivent être IMPOSÉS par le système plutôt que simplement demandés lorsqu’un agent s’exécute sans surveillance sur des outils payants avec une étape de publication externe ?

    • A. Un point de contrôle d’approbation avant la publication
    • B. Un plafond de dépense strict sur les outils payants
    • C. Une préférence pour un ton d’écriture formel
    • D. Une suggestion de conclure avant le déjeuner
    • E. Une préférence pour les puces
    Afficher la réponse

    Réponse : A et B.

    La publication irréversible nécessite un point de contrôle d’approbation imposé (A) et les outils payants nécessitent un plafond de dépense imposé (B) pour que le pire cas soit borné et connu. Le ton (C), un souhait de calendrier (D) et la mise en forme (E) sont des préférences pour lesquelles des limites respectées suffisent.

  33. Q33D4 · Limites et garde-fousSélectionnez une réponse

    Un dirigeant soutient que « l’agent s’est parfaitement comporté en test, donc nous pouvons lui faire confiance pour respecter la règle de non-envoi en production ». Quel est le contre-argument le plus fort ?

    • A. Il a raison ; des tests cohérents prouvent qu’il est sûr
    • B. Le comportement habituel n’est pas un contrôle ; une seule mauvaise lecture sur une entrée inhabituelle peut franchir irréversiblement une ligne simplement demandée, donc imposez le verrou
    • C. Les tests sont sans rapport avec le comportement de l’agent
    • D. Un modèle plus grand supprimerait le besoin de tout verrou
    Afficher la réponse

    Réponse : B.

    Une limite respectée peut tenir 99 % du temps et échouer une seule fois de manière catastrophique sur une action irréversible, si bien que l’imposition est requise quel que soit le comportement en test. Faire confiance au comportement en test (A) confond habituel et garanti, les tests ne sont pas sans rapport (C), et aucun modèle (D) ne supprime le besoin de verrouiller une action irréversible.

  34. Q34D4 · Limites et garde-fousSélectionnez une réponse

    Quelle est la façon la PLUS forte de garantir qu’un agent ne peut pas déplacer un jeu de données réglementé dans un message sortant ?

    • A. Lui indiquer dans le brief de ne pas inclure de données réglementées
    • B. Ne pas accorder du tout à l’agent la portée d’atteindre le jeu de données réglementé
    • C. Lui demander de résumer le jeu de données avec soin
    • D. Augmenter le niveau de raisonnement pour qu’il soit plus prudent
    Afficher la réponse

    Réponse : B.

    La limite de données la plus forte est architecturale : un agent ne peut pas déplacer ce qu’il n’a jamais pu atteindre. L’instruction (A) peut être manquée, un résumé soigné (C) touche quand même les données, et un effort plus élevé (D) ne crée pas de limite de données.

  35. Q35D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Une partie prenante s’appuiera sur un livrable produit par un agent dans une heure. Quelle approche UNIQUE offre le plus de valeur de vérification dans ce temps limité ?

    • A. Relire deux fois la synthèse de l’agent pour se rassurer
    • B. Vérifier par rapport à la définition de « terminé », puis pondérer le contrôle par échantillonnage selon le risque et reproduire l’unique affirmation à plus fort enjeu
    • C. Relancer toute la tâche depuis le début
    • D. Demander à l’agent de noter son propre travail
    Afficher la réponse

    Réponse : B.

    Cocher les critères d’acceptation, pondérer l’échantillon selon le risque et reproduire l’affirmation à plus fort enjeu concentrent le temps limité là où les erreurs comptent le plus. Relire la synthèse (A) et l’autonotation (D) ne vérifient rien d’indépendant, et tout relancer (C) gaspille l’heure.

  36. Q36D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Un agent affirme avoir « examiné les 90 pages » mais la trace de preuve montre qu’il n’en a ouvert que 66. Qu’est-ce qui s’est le PLUS probablement produit, et que devez-vous faire ?

    • A. Rien d’inhabituel ; faites confiance à l’affirmation
    • B. Un achèvement partiel silencieux — les pages non examinées doivent être traitées et le brief resserré pour exiger un signalement de couverture
    • C. Un modèle halluciné nécessitant un remplacement
    • D. Une erreur de niveau de raisonnement
    Afficher la réponse

    Réponse : B.

    Signaler une couverture complète alors que la trace montre un travail partiel est un achèvement partiel silencieux, détecté en confrontant la trace à l’affirmation ; le correctif traite le reste et ajoute une exigence de couverture. Ce n’est pas normal (A), ce n’est pas un « modèle halluciné » (C), et ce n’est pas un réglage d’effort (D) — c’est un écart entre la couverture et l’affirmation.

  37. Q37D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Quel énoncé explique le MIEUX pourquoi la synthèse d’achèvement est la partie la MOINS fiable d’un livrable non surveillé ?

    • A. Les synthèses sont toujours plus courtes que le travail
    • B. C’est la propre affirmation de l’agent sur son travail, produite par le même raisonnement, et l’aisance peut masquer un achèvement partiel silencieux
    • C. Les synthèses sont rédigées dans une langue différente
    • D. Les synthèses utilisent plus de tokens que les artefacts
    Afficher la réponse

    Réponse : B.

    La synthèse est un compte rendu du même raisonnement qui a fait le travail, et son aisance peut dissimuler une couverture manquante, elle doit donc être confrontée aux artefacts et à la définition de « terminé ». La longueur (A), la langue (C) et l’usage des tokens (D) ne sont pas la raison de son manque de fiabilité.

  38. Q38D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Vous vérifiez une sortie d’agent en masse en échantillonnant 8 éléments sur 80 ; deux échouent. Quelle est la conclusion la PLUS défendable ?

    • A. Les 72 autres vont bien ; un faible taux d’échec est acceptable
    • B. Les échecs invalident l’hypothèse d’une qualité uniforme ; élargissez substantiellement le contrôle ou rejetez et relancez le lot
    • C. Corriger les deux et livrer les 78 restants sans les contrôler
    • D. Le contrôle par échantillonnage n’est pas fiable, donc ignorez le résultat
    Afficher la réponse

    Réponse : B.

    Des échecs dans l’échantillon signifient que vous ne pouvez plus supposer que les éléments non contrôlés sont corrects, donc vous élargissez le contrôle ou rejetez le lot. Supposer que le reste va bien (A) et livrer 78 éléments non contrôlés (C) ignorent le signal, et le contrôle par échantillonnage est une technique valable (D).

  39. Q39D5 · Relire et vérifier le travail de l’agentSélectionnez deux réponses

    En temps limité, quels DEUX contrôles vérifient le mieux l’affirmation d’un agent selon laquelle il a « corrigé tous les liens cassés » dans une grande base de connaissances ?

    • A. Tester un échantillon pondéré selon le risque parmi les liens qu’il dit avoir corrigés, en priorisant les pages destinées aux clients
    • B. Tester quelques liens qu’il n’a pas mentionnés, au cas où il les aurait manqués
    • C. Relire sa synthèse plus attentivement
    • D. Lui demander de confirmer dans le même chat
    • E. Supposer l’achèvement parce que le rapport est détaillé
    Afficher la réponse

    Réponse : A et B.

    Un échantillon pondéré selon le risque parmi les corrections revendiquées (A) et un contrôle adverse des liens qu’il n’a pas mentionnés (B) concentrent l’effort sur les échecs probables et à fort enjeu. Relire la synthèse (C) et demander dans la session (D) ne vérifient rien d’indépendant, et le niveau de détail (E) n’est pas une preuve d’achèvement.

  40. Q40D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Pourquoi devriez-vous préférer relire l’artefact plutôt que l’assertion de l’agent à son sujet ?

    • A. L’assertion est plus facile à lire, donc préférez-la
    • B. L’artefact — la liste de modifications réelle ou le fichier mis à jour — est vérifiable, alors que l’assertion n’est qu’une affirmation à son sujet
    • C. Ils contiennent une information identique
    • D. Le plus court des deux est le plus exact
    Afficher la réponse

    Réponse : B.

    L’artefact est le produit de travail concret et vérifiable, tandis que l’assertion n’est qu’une description qui pourrait être fausse. Préférer l’assertion par facilité (A) fait confiance au récit, ils ne sont pas identiques (C), et la longueur (D) ne détermine pas l’exactitude.

  41. Q41D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Le rapport d’un agent se lit aisément, mais vous ne pouvez pas vérifier une affirmation au regard d’un quelconque artefact ou source. En appliquant la discipline de relecture, quelle est la MEILLEURE interprétation ?

    • A. L’affirmation est correcte parce que le rapport est fluide
    • B. La définition de « terminé » était trop vague pour contrôler cette affirmation ; traitez-la comme non vérifiée et affinez le brief à la prochaine itération
    • C. Le modèle est cassé et doit être remplacé
    • D. Le travail d’un agent ne peut jamais être vérifié
    Afficher la réponse

    Réponse : B.

    Une affirmation invérifiable signale généralement un défaut de brief en amont — aucun critère contrôlable — donc traitez-la comme non vérifiée et corrigez le brief la prochaine fois. L’aisance n’est pas une preuve (A), ce n’est pas un modèle cassé (C), et le travail d’un agent est vérifiable lorsque le brief le permet (D).

  42. Q42D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Quelle séquence est la relecture structurée la PLUS efficace d’une exécution d’agent de quarante minutes avant de consacrer du temps à la transcription complète ?

    • A. Transcription, puis plan, puis synthèse
    • B. Plan, puis points de contrôle, puis vérification par rapport à la définition de « terminé », puis inspection des artefacts, puis contrôle par échantillonnage
    • C. Synthèse uniquement, puis clôturer la tâche
    • D. Reproduire chaque affirmation avant de lire quoi que ce soit
    Afficher la réponse

    Réponse : B.

    L’ordre structuré — plan, points de contrôle, critères de « terminé », artefacts, contrôle par échantillonnage — vous permet de vous arrêter tôt si une étape en amont échoue, réservant la transcription pour la fin. Lire la transcription d’abord (A) est la démarche lente, la synthèse seule (C) ne vérifie rien, et reproduire chaque affirmation (D) est peu pratique et saute des contrôles moins coûteux.

  43. Q43D6 · Fiabilité et itérationSélectionnez une réponse

    Un agent de tri hebdomadaire présente trois symptômes à la fois : montants erronés, enregistrements manquants alors qu’il signale « tout traité », et entrées ultérieures dérivant en ton. Quelle approche est la PLUS disciplinée ?

    • A. Conclure que les agents ne peuvent pas faire la tâche et passer au plus grand modèle
    • B. Reconnaître trois modes d’échec distincts, instrumenter l’exécution, puis itérer un changement diagnostiqué à la fois en retestant sur des entrées variées
    • C. Réécrire tout le brief d’un coup et livrer immédiatement
    • D. Faire confiance à l’affirmation « tout traité » parce que cela a fonctionné au premier test
    Afficher la réponse

    Réponse : B.

    Les symptômes renvoient à une mauvaise source, un achèvement partiel silencieux et une dérive — trois modes ayant chacun son propre correctif — donc vous instrumentez, puis changez une chose à la fois et retestez sur des entrées variées. Un modèle plus grand (A) ne corrige aucune cause, tout réécrire d’un coup (C) masque ce qui fonctionnait, et faire confiance à l’affirmation d’achèvement (D) ignore l’achèvement partiel.

  44. Q44D6 · Fiabilité et itérationSélectionnez une réponse

    Dans la taxonomie des échecs, quel correctif s’apparie correctement avec « l’agent s’est bloqué et n’a pas pu atteindre le système de ticketing » ?

    • A. Affiner l’objectif
    • B. Accorder un connector restreint au système de ticketing (un correctif de mauvais outil/d’accès)
    • C. Ajouter une exigence de couverture à la définition de « terminé »
    • D. Passer à un modèle plus petit
    Afficher la réponse

    Réponse : B.

    Un blocage faute de portée est une défaillance de mauvais outil/d’accès, corrigée en provisionnant le connector précis au moindre privilège. Affiner l’objectif (A) traite les objectifs mal compris, une exigence de couverture (C) traite l’achèvement partiel, et la taille du modèle (D) est sans rapport avec l’accès.

  45. Q45D6 · Fiabilité et itérationSélectionnez deux réponses

    Un agent a « fait quelque chose d’adjacent à ce que vous vouliez ». Quels DEUX énoncés diagnostiquent et corrigent correctement cela ?

    • A. C’est un objectif mal compris — l’objectif était énoncé comme une tâche ou était ambigu
    • B. Reformuler l’objectif comme un résultat concret et vérifiable avant de relancer
    • C. C’est de la dérive ; le seul correctif est d’augmenter le niveau de raisonnement
    • D. C’est un achèvement partiel silencieux ; ajoutez un contrôle de couverture
    • E. C’est un accès manquant ; accordez davantage de connectors
    Afficher la réponse

    Réponse : A et B.

    Produire quelque chose de proche mais pas conforme à l’objectif est un objectif mal compris (A), corrigé en le reformulant comme un résultat vérifiable (B). La dérive (C) est une dégradation progressive, l’achèvement partiel silencieux (D) est une fausse affirmation d’exhaustivité, et l’accès manquant (E) se manifeste par un blocage ou des données erronées — aucun ne correspond à « adjacent à ce que vous vouliez ».

  46. Q46D6 · Fiabilité et itérationSélectionnez une réponse

    Qu’est-ce qui distingue le MIEUX une délégation fiable d’une délégation chanceuse ?

    • A. La fiable a utilisé un modèle plus cher
    • B. La fiable satisfait la définition de « terminé » sur des entrées variées et plus difficiles, pas seulement l’unique cas facile qui a fonctionné par hasard
    • C. La chanceuse avait un brief plus long
    • D. Il n’y a aucune différence en pratique
    Afficher la réponse

    Réponse : B.

    La fiabilité se définit par la tenue sur des entrées variées et des cas limites, alors que la chance est une seule entrée facile qui réussit. Le coût du modèle (A) et la longueur du brief (C) ne déterminent pas la fiabilité, et la distinction est bien réelle (D).

  47. Q47D6 · Fiabilité et itérationSélectionnez une réponse

    Vous avez observé un échec et voulez itérer. En appliquant la boucle LEARN, quel est l’ordre correct des étapes intermédiaires ?

    • A. Réviser un changement, puis examiner l’instrumentation, puis attribuer un mode
    • B. Examiner l’instrumentation, l’attribuer à un mode de la taxonomie, puis réviser exactement une chose
    • C. Attribuer un mode, tout réviser d’un coup, puis examiner le résultat
    • D. Réviser d’abord le modèle, puis examiner, puis attribuer
    Afficher la réponse

    Réponse : B.

    LEARN examine l’instrumentation, attribue l’échec à un mode, puis révise une chose avant de retester sur une nouvelle entrée. Réviser avant d’examiner ou d’attribuer (A, D) saute le diagnostic, et tout réviser d’un coup (C) vous empêche de savoir ce qui a fonctionné.

  48. Q48D6 · Fiabilité et itérationSélectionnez une réponse

    Pourquoi l’instrumentation est-elle un prérequis pour une itération fiable, plutôt qu’un supplément facultatif ?

    • A. Elle fait s’exécuter l’agent plus vite
    • B. Vous ne pouvez pas classer ni corriger un échec que vous ne pouvez pas voir ; le plan, la trace de preuve et le résultat-par-rapport-au-terminé révèlent dans quel mode vous êtes
    • C. Elle met automatiquement à niveau le modèle
    • D. Elle n’est pertinente que pour les développeurs qui écrivent du code
    Afficher la réponse

    Réponse : B.

    L’instrumentation rend le comportement observable pour que vous puissiez classer l’échec et cibler le correctif au lieu de deviner. Il ne s’agit pas de vitesse (A) ni de mise à niveau du modèle (C), et c’est une discipline de délégation pour tout travailleur du savoir, pas seulement les développeurs (D).

  49. Q49D6 · Fiabilité et itérationSélectionnez deux réponses

    Une délégation a réussi une fois sur une entrée facile. Quelles DEUX actions établissent le mieux si elle est réellement fiable ?

    • A. La retester sur une entrée plus difficile avec des cas limites
    • B. La retester sur une entrée différente mais réaliste et vérifier qu’elle satisfait toujours la définition de « terminé »
    • C. Relancer l’entrée facile identique plusieurs fois de plus
    • D. Passer à un modèle moins cher et livrer
    • E. La déclarer fiable parce qu’elle a fonctionné une fois
    Afficher la réponse

    Réponse : A et B.

    La fiabilité se prouve en retestant sur des entrées plus difficiles et sur des entrées différentes et réalistes tout en confirmant que la définition de « terminé » tient toujours (A, B). Relancer la même entrée facile (C) ne prouve rien de nouveau, un modèle moins cher (D) n’établit pas la fiabilité, et un seul succès (E) n’est qu’une hypothèse.

  50. Q50D6 · Fiabilité et itérationSélectionnez une réponse

    Un agent en dérive sur une longue exécution reçoit la consigne, plus ferme, de « rester sur la tâche », et pourtant il dérive de nouveau. Qu’est-ce que cela démontre le PLUS clairement ?

    • A. Le brief a simplement besoin d’une formulation encore plus ferme
    • B. La dérive est un problème structurel : une instruction respectée ne tiendra pas sur une longue exécution, donc ajoutez des points de contrôle ou raccourcissez le périmètre
    • C. Le modèle est défectueux et doit être remplacé
    • D. La tâche est impossible à déléguer
    Afficher la réponse

    Réponse : B.

    La dérive sur une longue exécution non surveillée nécessite des correctifs structurels — des points de contrôle qui réancrent ou des exécutions plus courtes et délimitées — car une instruction respectée ne peut pas tenir sur toute la durée. Une formulation plus ferme (A) reste une simple limite respectée, le modèle n’est pas nécessairement défectueux (C), et la tâche n’est pas impossible (D).

Dernière mise à jour le 18 sept. 2026