AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Annexes · Claude

Cadres de décision

Chaque arbitrage A-contre-B testé par les quatre examens, consolidé en une référence unique avec le signal de scénario qui pointe vers chaque réponse.

Les examens sont des examens d’arbitrage. Cette page consolide les décisions à travers les quatre blueprints. Pour chacune : les options, les mots-signaux dans un énoncé, et le choix correct pour l’examen.

Architecture

DécisionOption AOption BSignal → choix
Workflow vs agentWorkflow — chemins de code prédéfinisAgent — le modèle dirige ses propres étapesÉtapes connues et répétables → workflow. Ouvert, chemin dépendant des constats → agent. Par défaut le plus simple.
Appel unique vs chaîneUn promptChaînage de prompts avec barrièresÉtapes distinctes avec sortie intermédiaire vérifiable → chaîne
RoutageUn prompt généraliste uniqueClassifieur → prompts/modèles spécialistesEntrées hétérogènes à traitements différents → router (routeur bon marché)
ParallélisationSéquentielSectionnement (parties indépendantes) / vote (même tâche ×N)Sous-tâches indépendantes ou besoin de consensus → parallèle
Orchestrateur-workersDécomposition fixeL’orchestrateur décompose dynamiquementSous-tâches inconnues jusqu’à inspection → orchestrateur
Évaluateur-optimiseurPasse uniqueGénérer → évaluer → affinerCritères d’évaluation clairs et valeur itérative → boucle ; évaluateur dans une session séparée
HébergementManaged Agents — Anthropic héberge boucle + sandboxAgent SDK / Tool Runner — vous hébergezBesoin de contrôle sur runtime, réseau, localité des données → auto-héberger ; vouloir le moins d’ops → managed
Subagents vs workflows dynamiquesSubagents/forksWorkflows dynamiques scriptésQuelques tâches déléguées → subagents ; dizaines–centaines → workflows dynamiques
Construire vs escalader (Associate)Configurer dans claude.ai/ProjectsEscalader vers Developer/ArchitectNécessite API, automatisation, intégration ou garanties de niveau système → escalader

Contrôle de boucle et application

DécisionCorrectAnti-pattern
Terminaison de boucleBrancher sur stop_reasonParser la prose pour « done » ; plafond d’itérations arbitraire comme arrêt principal
Règle métier critiqueHook programmatique (PreToolUse) / permission d’outilPhrase dans le prompt système
Déclencheur d’escaladeDemande explicite → immédiat ; au-delà des capacités → résoudre-puis-escaladerSentiment ; confiance auto-déclarée
Signalement d’erreurStructuré : category, retryable, résultats partielsMessage générique ; succès vide silencieux
Auto-relectureSession fraîche ou modèle différent« êtes-vous sûr ? » dans la même session
Métrique de qualitéPar segment / par type de documentAgrégée uniquement
Nombre d’outils4–5 outils ciblés ; recherche d’outils + defer_loading au-delà de ~1018 outils chargés d’emblée

Mécanique de l’API

DécisionOption AOption BSignal → choix
Temps réel vs BatchMessages APIMessage Batches (50 % de réduction, ≤24 h)« Du jour au lendemain », « le coût compte, pas la latence », en masse → Batch
StreamingNon-streamingStreaming SSEUI interactive, longues sorties, latence perçue → streamer
Sortie structuréePrompt « renvoie du JSON »output_config.format / outils strictSortie consommée par machine → imposée par schéma ; toujours valider + réessayer
Appel d’outil forcétool_choice: any/toolauto + instruction / strict / sortie structuréeFable 5.1 → B (A donne 400)
Thinkingbudget_tokens{"type":"adaptive"}Modèles actuels → adaptive (Haiku 4.5 est l’exception)
Efforthigh (défaut)low/medium pour le mécanique ; xhigh pour le plus durSubagent faisant du travail de routine → low/medium
CachingAucuncache_control sur le préfixe stableLong préfixe répété ≥1024 tokens → cache ; le stable en premier
Contexte trop longTroncature côté clientContext editing / compaction (côté serveur)Tool results verbeux → edit ; long récit → compact ; Fable 5.1 → côté serveur uniquement
État persistantHistorique de conversationMemory tool / fichiers / DBDoit survivre à la compaction ou aux sessions → externe
RetryTout réessayerBackoff sur 429/5xx/529 uniquement ; respectez retry-afterErreurs client 4xx → corriger, ne pas réessayer
Modèle de repliN’importe lequelModèle plus récent ou équivalentDe Fable 5.1 vers plus ancien → blocs de thinking supprimés ; prévoyez la replanification

Sélection de modèle

SignalChoix
Classification, routage, extraction à l’échelle, sous la secondeHaiku 4.5
Tâches générales à l’équilibre qualité/coût, chat clientSonnet 5
Coding agentique complexe, défaut en entrepriseOpus 5
Raisonnement de pointe, budget secondaire, accepter les contraintesFable 5.1
Difficulté mixteCascade bon marché → cher avec validateur externe
Latence critiqueModèle plus petit, streaming, sortie plus courte, caching, mode rapide
Coût critiqueModèle plus petit, caching, Batch, réduire la sortie, effort moindre

Prompting et contexte

DécisionChoixSignal
Zero-shot vs few-shotFew-shotSensible au format, ambigu, cas limites
CoT vs extended thinkingThinking étendu/adaptatifRaisonnement dur ; garder la sortie visible propre
Placement des documentsDocuments en premier, question en dernierRappel en long contexte + préfixe cachable
Frontière données vs instructionBalises XMLContenu non fiable ; risque d’injection
Le prompt comme actifVersionné, testé, stable pour le cachePrompt système de production
Isolation du contexteSubagent avec contexte expliciteProtéger le contexte principal ; exploration parallèle
Plan vs direct (Claude Code)Mode planMulti-fichiers, architectural, inconnu, irréversible
Skill vs CLAUDE.md vs command vs subagent vs MCPVoir tableauProcédure → Skill ; conventions → CLAUDE.md ; ligne unique paramétrée → command ; tâche déléguée isolée → subagent ; système externe → MCP

Outils et MCP

DécisionChoixSignal
Outil personnalisé vs serveur MCPMCPRéutilisé entre hosts/agents ; système externe
stdio vs Streamable HTTPHTTPDistant, multi-utilisateur, nécessite OAuth
Qualité de la description d’outilRiche : quoi/quand/quand-pas/retoursLe modèle choisit le mauvais outil → corriger d’abord la description
Outil destructif exposé mais inutileLe supprimerPas « le journaliser » ni « le confirmer »
IdentitéPropagation OAuth par utilisateurApplication multi-tenant ; faille d’authz
Appels d’outils parallèlesAutoriserRecherches indépendantes

RAG (Professional)

DécisionChoixSignal
RAG vs long contexte vs fine-tuningRAGCorpus grand/changeant, citations nécessaires. Long contexte : petit corpus stable tient dans 1M. Fine-tuning : style/format, pas les faits
ChunkingStructurel/conscient du document ; parent-childDocs structurés ; besoin de hits précis avec contexte large
RécupérationHybride (dense + BM25) + rerankerRequêtes mêlant paraphrase et ID exact
Traitement de requêteRéécriture / multi-query / HyDEQuestions vagues ou multi-intentions
Confiant-mais-faux après rafraîchissement des docsSuspecter d’abord la récupération/l’indexationIndex périmé, dérive de chunks
Eval de récupérationrecall@k, MRR, faithfulness, answer relevanceSéparer la qualité de récupération de la qualité de génération

Évaluation

DécisionChoixSignal
GraderExact match → rubrique → LLM-as-judge (modèle séparé, calibré)Subjectivité croissante
A/BPar paires avec significativitéComparer prompts/modèles
OùJeu golden hors-ligne + canary en ligneAvant et après la release
CISuite de régression conditionnant le déploiementChangement de prompt ou de modèle
Vue des métriquesPar segment + agrégéeToujours les deux
Cause racineCouche d’intégration vs sortie modèle vs récupérationVérifier les traces avant de changer les prompts

Gouvernance et sécurité

DécisionChoixSignal
Action irréversible / réglementée / externe / PIIBarrière human-in-the-loop« ne doit jamais », « publier », « payer », « supprimer », « diagnostic »
Classe de données → outilSuivre la classification et la politiqueDonnées restreintes → uniquement la surface d’entreprise approuvée
RétentionZDR là où requisRéglementé ; noter l’exclusion de Fable 5.1
Cadre de conformitéGDPR (données personnelles UE), HIPAA (PHI, BAA), FedRAMP High (fédéral US via Bedrock/Vertex), SOC 2Mots sectoriels dans l’énoncé
Garde-fousEn couchesJamais mono-couche
DivulgationPrévenir les utilisateurs quand l’IA est impliquéeCommunications externes, décisions concernant des personnes

Parties prenantes et cycle de vie (Professional)

DécisionChoixSignal
DécouverteEntretiens structurés → métriques de succès → contraintesExigences vagues
Communiquer les arbitragesADR + matrice de décision + modèle de coût + registre des risquesSponsor non technique
AttentesAlignement SLA/SLO avec des références de base mesurées« Les dirigeants attendent 100 % de précision »
Cycle de vieDécouverte → conception → construction → transfert → supervision → itération avec critères de sortieLe transfert sans runbooks est le distracteur
Dépréciation de modèleTraiter comme un événement de cycle de vie planifié avec migration conditionnée par l’evalAvis de retrait

Optimisation du coût et de la performance

DécisionChoixSignal
Latence trop hauteModèle plus petit → streaming → max_tokens plus court → caching → mode rapide« p95 trop lent », « les utilisateurs attendent »
Coût trop élevéModèle plus petit → caching → Batch → réduire la sortie → effort moindre« les dépenses sont trop élevées », « réduire le coût »
Long préfixe répétéPrompt caching, disposition stable-en-premier« le même prompt système à chaque appel »
En masse, tolérant à la latenceBatch API (50 %)« du jour au lendemain », « des millions d’éléments »
Flux de difficulté mixteCascade bon marché→cher avec validateur externe« la plupart des tickets sont simples, certains durs »
Réduire les allers-retours en logique multi-outilsAppel d’outils programmatique« nombreux appels d’outils séquentiels »
Réduire les tokens dans les longues exécutions d’agentContext editing (effacer les tool results)« le contexte grossit sans cesse », « sortie d’outil verbeuse »
Réglage de l’effortlow/medium mécanique, high défaut, xhigh le plus dur« le subagent renomme des fichiers » → low

Fiabilité et gestion des défaillances

DécisionChoixAnti-pattern rejeté
Sortie de boucleBrancher sur stop_reasonParse de prose ; plafond d’itérations comme arrêt principal
Sortie tronquée (max_tokens)Continuer / augmenter le plafondTraiter comme complet
Arrêt refusalChemin de repli expliciteErreur générique ; réessai aveugle
pause_turnRenvoyer pour continuerTraiter comme un échec
429/5xx/529 transitoiresBackoff + jitter + retry-afterTempête de retries ; réessayer les 4xx
Échec d’outilis_error structuré (category, retryable, partiel)Message générique ; succès vide silencieux
Réessai à effet de bordClé d’idempotenceDouble facturation au réessai
Repli de modèlePlus récent ou équivalent uniquementLa migration vers le bas supprime les blocs de thinking de Fable 5.1
Déclencheur d’escaladeDemande explicite / au-delà des capacitésSentiment ; confiance auto-déclarée

Gestion des données et des connaissances

DécisionChoixSignal
Petit corpus stable tenant dans la fenêtreLong contexte (pas de récupération)« manuel de 50 pages, change rarement »
Corpus grand / changeant, citationsRAG« des milliers de docs », « doit citer »
Style/format et non faitsFine-tuning / exemples« correspondre à notre ton », « toujours ce format »
État entre sessionsMemory tool / stockage externe« se souvenir entre chats », « survivre à la compaction »
Docs structurés, précis + largeChunking parent-child« tableaux et sections », « besoin de contexte autour des hits »
Requête vague / multi-intentionsRéécriture / multi-query / HyDE« les utilisateurs posent des questions floues »
Requêtes mêlant ID exact + paraphraseHybride (dense + BM25) + reranker« numéros de commande et langage naturel »
Confiant-mais-faux après rafraîchissementSuspecter d’abord la récupération/l’indexation« marchait avant la mise à jour du doc »

Profondeur du prompting

DécisionChoixSignal
Sensible au format / cas limitesFew-shot avec exemples représentatifs« la sortie varie », « format spécifique »
Raisonnement dur, sortie propreThinking adaptatif/étendu« montre ton raisonnement mais garde la réponse propre »
Contenu non fiable dans le promptFrontières XML, traiter comme des données« fourni par l’utilisateur », « contenu web »
Orienter le début de la sortiePrefill (ou sortie structurée pour des garanties)« commence toujours par », « JSON uniquement »
Sortie consommée par machineoutput_config.format + valider/réessayer« un système en aval la parse »
Protéger le contexte principalSubagent avec contexte explicite« exploration parallèle », « ne pas polluer le contexte »

Index rapide mot-signal → principe

Recherche rapide : la formulation exacte qu’emploient les rédacteurs d’items, et le principe qu’elle désigne. Quand deux formulations apparaissent dans un même énoncé, la contrainte (coût, latence, conformité, fiabilité) décide généralement.

Formulation d’énoncéDésigne
« le PLUS économique »Le modèle / Batch / caching le moins cher qui satisfait encore les contraintes
« PREMIÈRE étape »Le diagnostic réversible le moins cher avant de gros changements
« MEILLEURE approche »La conception la plus simple satisfaisant chaque contrainte énoncée
« Choisir DEUX »Deux actions indépendamment correctes ; attention à un-juste-un-plausible
« à l’échelle » / « des millions »Haiku 4.5 + Batch + caching
« sous la seconde » / « temps réel »Modèle plus petit, streaming, effort faible ; pas Batch
« du jour au lendemain » / « la latence n’importe pas »Batch API (50 %)
« le même long prompt à chaque requête »Prompt caching, préfixe-stable en premier
« ne doit jamais » / « en aucun cas »Hook déterministe / permission d’outil, pas une phrase de prompt
« comment la boucle sait-elle qu’elle a fini »stop_reason: end_turn, pas le parsing de prose
« quand devrait-il escalader »Demande explicite ou au-delà des capacités ; pas le sentiment/l’auto-déclaration
« l’agent a continué indéfiniment »Terminer sur stop_reason, pas un plafond d’itérations
« renvoie rien / vide »is_error / not_found structuré ; anti-pattern de succès silencieux
« confiance » / « à quel point êtes-vous sûr »Ne pas router sur la confiance auto-déclarée
« en colère » / « client frustré »Sentiment ≠ complexité ; ne pas escalader sur le ton
« la précision globale est de 95 % »Exiger des métriques par segment
« êtes-vous sûr ? » dans le même chatSession fraîche / modèle différent pour la relecture
« 18 outils » / « trop d’outils »4–8 outils ; recherche d’outils + defer_loading
« forcé d’appeler un outil » + Fable 5.1auto+instruction / strict / sortie structurée (forcé = 400)
« forme JSON garantie »output_config.format / strict: true + validation
« les blocs de thinking ont disparu après un repli »Liaison de Fable 5.1 ; migrer uniquement vers le haut
« la fenêtre de contexte est pleine »Context editing (tool results) ou compaction (récit)
« a édité un tour antérieur » + Fable 5.1Historique en ajout seul ; utiliser des messages system en milieu de conversation
« se souvenir entre sessions »Memory tool / stockage externe
« doit citer les sources »RAG + citations ; test de provenance
« marchait avant la mise à jour du document »Suspecter d’abord la récupération/l’indexation
« IDs exacts et paraphrases »Récupération hybride + reranker
« questions utilisateur vagues »Réécriture de requête / HyDE / multi-query
« doc de 50 pages qui change rarement »Long contexte, pas RAG
« correspondre à notre style d’écriture »Few-shot / fine-tuning, pas RAG
« réutilisé entre plusieurs applications/agents »Serveur MCP, pas un outil personnalisé
« serveur d’outils distant, multi-utilisateur »Streamable HTTP + OAuth 2.1, identité par utilisateur
« agit comme un compte admin partagé »Faille d’authz ; propager l’identité de l’utilisateur final
« outil delete/refund dont il n’a pas besoin »Le supprimer (moindre privilège), pas journaliser/confirmer
« le contenu web / la sortie d’outil lui a dit de… »Injection indirecte ; traiter comme des données, frontières
« règle dure dans le prompt système »Anti-pattern du prompt-comme-application ; utiliser un hook
« changement multi-fichiers / architectural » (Claude Code)Mode plan
« une édition unique évidente »Mode direct
« procédure multi-étapes réutilisable »Skill
« conventions du dépôt / commandes de build »CLAUDE.md
« ligne unique paramétrée »Slash command
« tâche déléguée isolée »Subagent
« dizaines–centaines d’agents »Workflows dynamiques
« quelques tâches déléguées »Subagents / forks
« rôles nommés collaborant »Agent teams
« job récurrent planifié »Routines
« distribuer commandes/agents/hooks/MCP »Plugins
« exécuter en CI / headless »claude -p --output-format json, outils restreints
« noter une qualité subjective »Rubrique → LLM-as-judge (session séparée), calibré
« comparer deux prompts/modèles »A/B par paires avec significativité statistique
« conditionner le déploiement »Suite de régression CI sur le jeu golden
« avant et après la release »Jeu golden hors-ligne + canary en ligne
« action réglementée / irréversible / externe »Barrière human-in-the-loop
« données personnelles UE »GDPR ; DPIA pour le haut risque
« données de santé / PHI »HIPAA + BAA
« fédéral US »FedRAMP High via Bedrock/Vertex
« les prompts ne doivent pas être conservés »ZDR (noter l’exclusion de Fable 5.1)
« sponsor non technique / dirigeants »ADR + matrice de décision + modèle de coût + registre des risques
« attendre 100 % de précision »Fixer des SLO/SLA face à des références de base mesurées
« transfert à l’équipe »Runbooks, supervision, critères de sortie
« quel modèle devrions-nous utiliser »Faire correspondre la matrice de capacités à la contrainte contraignante
« réduire les hallucinations »Ancrage (RAG/citations), validation, pas seulement « lui dire de ne pas »

Signal d’examen

Quand un énoncé empile un besoin de capacité contre une contrainte de conformité ou de coût, la contrainte l’emporte. « Nous voulons le connecteur MCP mais nous sommes ZDR-uniquement sur Fable 5.1 » est impossible tel qu’énoncé — reconnaissez le conflit plutôt que de choisir la fonctionnalité brillante.

Dernière mise à jour le 18 sept. 2026