AI Foundations
AI Foundations · Examen blanc 2
Un examen blanc indépendant plus difficile, chronométré, de 60 items pour la piste OpenAI Academy AI Foundations, utilisé comme test de préparation avant la véritable évaluation.
Ceci est le second examen blanc indépendant complet pour la piste AI Foundations, construit à partir des objectifs d’apprentissage OpenAI accessibles au public. Il n’est pas une évaluation officielle OpenAI. Il est délibérément plus difficile que l’Examen blanc 1 — plus d’énoncés à contraintes multiples, plus de qualificatifs FIRST / BEST / MOST cost-effective / TWO et davantage de mises en situation — utilisez-le donc comme test de préparation, chronométré, une fois que vous avez comblé les écarts révélés par le diagnostic. Les 60 items sont inédits et distincts de l’Examen blanc 1 comme des questions des pages de domaine.
Consignes
- Durée : 75 minutes. Passez celui-ci chronométré pour vous entraîner à travailler contre la montre.
- Items : 60, à réponse unique et à réponses multiples. Chaque item indique combien de réponses sélectionner.
- Sélection : les items à réponse unique demandent un seul choix ; les items à réponses multiples indiquent Sélectionnez deux réponses et vous devez en choisir exactement deux — toutes correctes et aucune incorrecte.
- Aucune pénalité pour les mauvaises réponses : répondez à chaque question ; un item sans réponse marque simplement zéro.
- Objectif : visez au moins 80 % brut (≈ 48/60) ici avant de passer la véritable évaluation Academy, car le seuil du badge Academy est de 80 %.
Répartition par domaine
| # | Domaine | Items ici |
|---|---|---|
| 1 | AI and Generative AI Fundamentals | 8 |
| 2 | How Language Models Behave | 10 |
| 3 | ChatGPT Surfaces and Features | 8 |
| 4 | Prompting and Instructions | 12 |
| 5 | Context, Files and Memory | 7 |
| 6 | Verifying and Evaluating Output | 9 |
| 7 | Responsible and Safe Use | 6 |
Total : 8 + 10 + 8 + 12 + 7 + 9 + 6 = 60 items.
Interprétation de la préparation
Ceci est un indicateur de préparation indépendant, pas un score et pas un seuil de réussite. Comme cet examen est plus difficile, un score dans les paliers supérieurs ici est un signal fort de préparation.
| Score brut | Palier | Signification |
|---|---|---|
| moins de 70 % | Continuez à apprendre | Le cadrage plus difficile a révélé de vrais écarts ; revoyez ces domaines avant l’évaluation. |
| 70–79 % | Confiance en construction | Solide, mais resserrez les domaines où les items à contraintes multiples vous ont piégé. |
| 80–89 % | Prêt pour l’évaluation | Au niveau ou au-dessus du seuil du badge Academy sur la série plus difficile ; vous êtes en bonne posture. |
| 90 %+ | Forte préparation | Excellent sur l’examen le plus exigeant ; vous êtes bien préparé pour l’évaluation Academy. |
La barre des 80 % correspond au seuil du badge OpenAI Academy. Un badge Academy ou un certificat de parcours n’est pas une certification et ne garantit pas l’éligibilité à une future certification OpenAI.
Passer l’examen blanc
Deux façons d’utiliser les questions ci-dessous. Le mode interactif lance une session chronométrée, une question à la fois, et se termine par votre score, une ventilation par domaine et une correction complète. Le mode révision en dessous liste chaque question avec ses options une par ligne et la réponse masquée jusqu’à ce que vous la demandiez.
Mode interactif
Passer l’examen d’entraînement
60 questions · une à la fois · compte à rebours de 75 minutes · résultats avec répartition par domaine et correction complète à la fin. Votre progression est enregistrée dans ce navigateur si vous quittez la page.
Par domaine
| Domaine | Correctes | Score |
|---|
Correction
Toutes les questions (mode révision)
Les options sont présentées une par ligne. La réponse et l’explication restent masquées jusqu’à ce que vous cliquiez sur Afficher la réponse. Utilisez le mode interactif ci-dessus pour une session chronométrée.
Une partie prenante affirme que, puisque ChatGPT a écrit du Python correct, il doit donc comprendre les mathématiques comme le fait une personne. Quelle est la correction la MOST accurate ?
Afficher la réponse
Réponse : B.
Le modèle génère des tokens probables ; une sortie correcte démontre une capacité, non une compréhension de type humain. A surestime. C est à l’envers, puisqu’il s’agit d’un modèle de langage. D suppose une restitution par cœur, ce qui décrit mal la prédiction générative du token suivant et est généralement faux pour des prompts inédits.
Vous devez estimer si une note de synthèse de 6 000 mots plus une annexe de 2 000 mots tiendront à côté d’instructions dans une fenêtre GPT Instant sur ChatGPT Business. En utilisant la règle empirique standard, quels sont la BEST estimation et la conclusion ?
Afficher la réponse
Réponse : B.
À environ quatre caractères par token, 8 000 mots représentent environ 10 700 tokens, bien en dessous de 54K, laissant de la place pour les instructions. A sous-estime en utilisant beaucoup trop peu de tokens par mot. C affirme à tort que 10 700 dépasse 54K. D surestime à la fois le nombre et se trompe sur la limite.
Une équipe demande la SINGLE explication générale la plus fiable de la raison pour laquelle un LLM compte parfois mal les lettres d’un mot. Laquelle est-ce ?
Afficher la réponse
Réponse : A.
Les modèles opèrent sur des tokens plutôt que sur des caractères, donc le comptage exact des lettres n’est pas une opération naturelle. B invente une fonctionnalité. C confond la récence de l’entraînement avec le traitement des caractères. D applique mal les limites de contexte à une tâche de comptage par mot.
Un travailleur du savoir souhaite la façon MOST cost-effective de gérer une tâche d’extraction répétable et à fort volume avec des règles claires, et demande quel facteur compte FIRST. Qu’est-ce qui devrait guider le choix ?
Afficher la réponse
Réponse : B.
Pour des tâches claires, répétables et à fort volume, un modèle léger et rapide est le choix économique. A dépense trop. C recourt à la mauvaise modalité. D optimise la récence, qui est sans rapport avec une tâche d’extraction fondée sur des règles.
Quelle affirmation capte le mieux pourquoi la fluidité n’équivaut pas à l’exactitude dans un texte généré ?
Afficher la réponse
Réponse : B.
Une formulation bien formée reflète la probabilité, non la vérité, donc un texte fluide peut être faux. A assimile à tort la fluidité à la justesse. C lie l’exactitude à la vitesse. D est faux, puisque les citations elles-mêmes peuvent être fabriquées.
Un collègue vous demande de nommer DEUX faits qui expliquent le mieux pourquoi une statistique précise et sans source à propos d’une petite entreprise privée devrait être traitée avec prudence.
Afficher la réponse
Réponse : A et B.
Le modèle peut fabriquer des chiffres précis, et les données privées de niche sont souvent indisponibles sans recherche. C est faux ; il n’y a pas de vérification intégrée. D est faux ; les nombres sans source sont courants. E est une exagération qui n’est pas la raison de la prudence.
Un manager soutient qu’adopter l’IA signifie que l’entreprise devrait cesser de recruter des analystes, car le modèle calcule tout de façon fiable. Quel est le cadrage le MOST accurate à proposer FIRST ?
Afficher la réponse
Réponse : B.
Le modèle assiste mais ne remplace pas le jugement humain, et le calcul exact nécessite des outils. A surestime la fiabilité. C sous-estime son utilité. D limite à tort les modes de défaillance à la récence, en ignorant l’hallucination et les erreurs arithmétiques.
Pour une tâche qui doit refléter un changement réglementaire intervenu il y a trois mois, quelle combinaison est le premier choix le MOST dependable ?
Afficher la réponse
Réponse : B.
Les faits récents nécessitent une récupération assortie d’une vérification par rapport à la source faisant autorité. A risque un contenu périmé ou fabriqué au-delà de la coupure. C ajoute du calcul mais ne peut pas fournir les faits récents manquants. D invite à une supposition assurée sans ancrage.
Un utilisateur règle ce qu’il croit être une température de zéro et déclare que le modèle ne peut plus halluciner ni varier. Quelle est la correction la MOST accurate ?
Afficher la réponse
Réponse : B.
Réduire l’aléatoire affecte la variation, non l’ancrage factuel, et le produit de chat n’expose pas la température brute. A confond le déterminisme avec la vérité. C se trompe sur ce que fait le réglage. D invente un mode de recherche par consultation qui n’existe pas.
Un utilisateur veut retrouver de façon fiable un excellent brouillon qu’il a généré la semaine dernière, mais la conversation a disparu. Quelle est la BEST pratique à l’avenir ?
Afficher la réponse
Réponse : B.
Parce que la génération est non déterministe, les sorties précieuses doivent être enregistrées intentionnellement. A attend une reproduction exacte qui n’aura pas lieu. C ne rend pas les sorties reproductibles. D suppose à tort que memory stocke des brouillons complets, ce qu’elle ne fait pas.
Sur ChatGPT Enterprise, un utilisateur compare les fenêtres de contexte totales de GPT Instant et GPT Reasoning et demande quel appariement est correct.
Afficher la réponse
Réponse : A.
Sur Enterprise, le total de GPT Instant est de 128K et celui de Reasoning est de 256K. B utilise le chiffre de Business Instant. C intervertit les deux valeurs. D cite une fenêtre à l’échelle de l’API, non applicable à ces forfaits ChatGPT.
Un utilisateur a besoin de la BEST qualité sur un problème de stratégie difficile et ouvert mais est soucieux des coûts. Quel raisonnement de sélection est le plus solide ?
Afficher la réponse
Réponse : B.
Un travail difficile et ouvert nécessite un modèle capable, mais l’effort doit correspondre à la difficulté plutôt que d’opter par défaut pour le maximum. A sous-dimensionne pour une tâche difficile. C associe un effort élevé à un modèle sous-dimensionné. D recourt à une modalité entièrement inadaptée.
Un modèle donne une réponse rapide et fausse à un problème enchaînant arithmétique et logique. Un utilisateur augmente le reasoning effort et cela s’améliore mais reste parfois faux. Quelle est l’étape suivante la MOST reliable ?
Afficher la réponse
Réponse : B.
Le calcul exact relève d’un outil, la logique étant vérifiée, car un effort accru à lui seul ne garantit pas la justesse arithmétique. A saute la vérification sur une tâche connue pour échouer. C réduit la rigueur. D s’appuie sur des générations faillibles répétées plutôt que sur un calcul ancré.
Un utilisateur remarque que le modèle approuve avec enthousiasme quelle que soit l’option qu’il présente favorablement. Pour obtenir l’aide à la décision la MOST balanced, que devrait-il faire FIRST ?
Afficher la réponse
Réponse : B.
Un cadrage neutre qui force des avantages, inconvénients et contre-arguments équilibrés contre la flagornerie. A amplifie le biais. C ajoute une capacité sans rapport avec le cadrage. D change de modalité et ne répond pas au besoin de raisonnement.
Dans une conversation de planification interminable, le modèle commence à contredire des décisions prises des heures plus tôt. Quelle explication et quel remède sont les MOST accurate ?
Afficher la réponse
Réponse : B.
Les longues conversations perdent le contexte initial ; reporter un résumé ou redémarrer préserve les décisions. A interprète mal un comportement normal. C confond la coupure d’entraînement avec le contexte en cours de conversation. D est une notion de facturation sans rapport avec les contradictions.
Sélectionnez les DEUX affirmations qui décrivent correctement les conséquences de la génération probabiliste et non déterministe pour un usage quotidien de ChatGPT.
Afficher la réponse
Réponse : A et B.
Le non-déterminisme explique la formulation variée et la nécessité d’enregistrer les bonnes sorties. C est faux ; les préférences ne fixent pas des octets exacts. D est faux ; il n’y a pas de vérification factuelle intégrée. E est faux ; variabilité et hallucination sont des phénomènes distincts.
Un utilisateur signale que la qualité s’est dégradée après avoir collé une douzaine de longs rapports peu pertinents dans une seule conversation, bien qu’un compteur de tokens montre qu’ils sont sous la fenêtre. Quels sont la cause et la correction les MOST likely ?
Afficher la réponse
Réponse : B.
Sous la limite, la pertinence et le volume comptent encore ; élaguer pour ne garder que les fichiers pertinents corrige la dilution. A contredit la prémisse et élague à l’aveugle. C invente une limitation. D ajoute du calcul sans réduire l’encombrement à l’origine du problème.
Un utilisateur doit confirmer le prix d’un concurrent annoncé ce matin, puis produire un tableau de coûts comparatif exact à partir d’une feuille de 300 lignes. Quel appariement de fonctionnalités est correct, dans l’ordre ?
Afficher la réponse
Réponse : B.
Search gère le fait récent et data analysis calcule des chiffres exacts. A détourne memory et la génération d’images. C utilise deep research pour un fait tenant en une ligne et attend à tort de canvas qu’il calcule. D est une fonctionnalité de tutorat qui ne fait ni l’une ni l’autre tâche.
Une équipe souhaite une configuration permanente et partagée d’instructions et de fichiers de référence sur laquelle les conversations de chaque membre peuvent s’appuyer pour un client, sans rien coller. Quel est le BEST choix ?
Afficher la réponse
Réponse : B.
Un Project partagé contient des instructions et des fichiers permanents accessibles à travers les conversations des membres. A est individuel et à petite échelle. C automatise le calendrier, non le contexte partagé. D se dégrade en grossissant et ne partage pas proprement la configuration.
Un utilisateur a besoin d’une synthèse multi-articles bien sourcée sur une norme de niche ET veut que chaque affirmation soit traçable jusqu’à une source. Quels fonctionnalité et suivi sont les BEST ?
Afficher la réponse
Réponse : B.
Deep research synthétise un matériel cité, et confirmer les citations clés rend les affirmations traçables. A n’offre aucune source. C et D sont les mauvaises modalités et ne fournissent aucune synthèse traçable.
Un manager insiste pour que chaque tâche s’exécute sur le modèle le plus puissant par sécurité. Quel point unique s’y oppose le mieux sur des bases de rapport coût-efficacité ?
Afficher la réponse
Réponse : B.
Faire correspondre modèle et effort à la tâche évite de payer des prix de pointe pour un travail simple. A est faux sur le coût. C est faux ; les modèles capables gèrent les tâches simples mais de façon coûteuse. D nie les différences réelles de coût et de latence.
Un analyste veut apprendre en profondeur une méthode de prévision plutôt que de recevoir les chiffres finaux, puis a besoin plus tard que les chiffres soient calculés exactement. Quelle séquence est la BEST ?
Afficher la réponse
Réponse : A.
Study mode enseigne la méthode ; data analysis calcule des chiffres exacts avec du code. B utilise search pour un concept et détourne memory pour le calcul. C est la mauvaise modalité. D saute l’apprentissage et risque une arithmétique peu fiable.
Sélectionnez les DEUX paires fonctionnalité-besoin correctement associées.
Afficher la réponse
Réponse : A et B.
Company knowledge répond à partir de sources internes connectées et canvas prend en charge l’édition en ligne. C devrait utiliser data analysis, non memory. D devrait utiliser search, non la génération d’images. E devrait utiliser un import de fichier, non une scheduled task.
Un utilisateur téléverse un PDF de 60 pages et demande un résumé qui énonce un chiffre de conformité spécifique qu’il transmettra au service juridique. Quelle est la posture correcte AVANT de transmettre ?
Afficher la réponse
Réponse : B.
Un chiffre à fort enjeu destiné au service juridique doit être vérifié par rapport au document source. A fait trop confiance au résumé. C s’appuie sur une confiance auto-déclarée. D altère le chiffre sans le confirmer.
Un prompt de tâche indique : tu es analyste financier ; à partir du CSV joint, rapporte les trois plus grandes catégories de coûts sous forme de tableau avec les colonnes Catégorie et Total ; le succès signifie que les totaux se réconcilient avec la feuille. Quels composants sont présents ?
Afficher la réponse
Réponse : A.
Le prompt nomme un rôle, une tâche, le CSV comme contexte, un format de tableau et un critère de réussite de réconciliation. B, C et D sous-comptent chacun les composants clairement présents dans l’énoncé, ils identifient donc mal le prompt bien formé.
Une sortie doit alimenter un importateur automatisé qui attend des champs fixes. La première tentative a renvoyé de la prose avec les données incorporées. Quelle est la BEST instruction unique à ajouter ?
Afficher la réponse
Réponse : B.
Un schéma défini sans prose superflue rend la sortie importable. A raccourcit la prose mais la laisse non structurée. C ajoute du calcul sans définir la structure. D change le ton, sans rapport avec un import automatisé.
Un prompt liste cinq interdictions et aucune cible positive ; les sorties continuent de manquer la cible. En appliquant la pensée d’anatomie du prompt, quelle est la correction unique la MOST effective ?
Afficher la réponse
Réponse : B.
Une cible positive avec un exemple oriente bien mieux que des interdictions empilées. A ajoute d’autres négations sans cible. C supprime des détails nécessaires. D ajoute de l’aléatoire, non une direction.
Un livrable complexe nécessite une étude, une recommandation, un plan de diapositives et un e-mail de synthèse, chacun dépendant du précédent. Quelle est la structure de prompting la MOST reliable ?
Afficher la réponse
Réponse : B.
Des étapes séquentielles et revues permettent de détecter les erreurs avant qu’elles ne se propagent aux livrables dépendants. A rend la revue et l’isolement des erreurs difficiles. C saute un travail requis. D introduit du désordre sans bénéfice.
Un utilisateur signale que le modèle ignore systématiquement la contrainte unique la plus importante. Quelle combinaison de corrections est la MOST likely à fonctionner ?
Afficher la réponse
Réponse : B.
La mise en évidence, l’étiquetage et sa transformation en critère vérifiable augmentent tous la probabilité que la contrainte soit respectée. A réduit la visibilité. C abandonne l’exigence. D la noie dans le bruit.
Deux prompts ne diffèrent que par le fait que l’un ajoute une audience nommée et un critère de réussite concret. Le second produit systématiquement de meilleures sorties. Qu’est-ce que cela illustre le mieux ?
Afficher la réponse
Réponse : B.
L’amélioration vient des spécificités pertinentes et d’un critère vérifiable, non de la longueur brute. A confond le mécanisme avec la longueur. C nie l’effet observé. D restreint à tort le principe à une seule catégorie de modèles.
Un utilisateur veut un e-mail de présélection qui invite à un appel et nomme une compétence spécifique de l’offre d’emploi. Dans l’anatomie du prompt, où appartiennent ces deux exigences ?
Afficher la réponse
Réponse : B.
Les actions requises et le contenu spécifique sont des éléments de tâche et de contrainte. A fixe un persona, non le contenu requis. C nomme à qui elle s’adresse, non ce qu’elle doit contenir. D définit la forme, non les actions requises ni la mention de la compétence.
Un premier brouillon est exact à 90 % mais utilise la mauvaise devise et une mauvaise date. Quelle est l’action d’itération la MOST disciplined ?
Afficher la réponse
Réponse : B.
Une correction précise et minimale préserve les 90 % qui fonctionnent et corrige les deux erreurs. A jette un bon travail. C répète les mêmes erreurs. D change d’outil alors qu’une petite modification suffit.
Sélectionnez les DEUX changements qui amélioreraient le plus un prompt dont la sortie était pertinente mais plate et destinée au mauvais lecteur.
Afficher la réponse
Réponse : A et B.
Une instruction de ton relève un texte plat et nommer l’audience corrige le problème du mauvais lecteur. C ajoute des négations sans cible. D ajoute du calcul sans rapport avec le ton ou l’audience. E répète le même manque.
Vous voulez des résumés cohérents de deux phrases sur 200 documents avec une structure identique. Quelle approche donne la forme la MOST consistent à grande échelle ?
Afficher la réponse
Réponse : B.
Un gabarit, un exemple et une structure explicite produisent une forme cohérente sur de nombreux éléments. A laisse la cohérence au hasard. C garantit la variation. D ajoute du coût sans imposer de structure.
Quel est le critère de réussite le STRONGEST pour une mise à jour trimestrielle du conseil d’administration, jugé selon son caractère vérifiable ?
Afficher la réponse
Réponse : B.
B est spécifique et vérifiable pour la longueur, le contenu et la réconciliation. A, C et D sont vagues et invérifiables, de sorte que le modèle ne peut pas les satisfaire de façon fiable ni savoir quand c’est fait.
Un collègue truffe ses prompts d’adjectifs en croyant que cela augmente la qualité, or les résultats ne sont pas meilleurs. Quelle est l’explication la MOST accurate à donner ?
Afficher la réponse
Réponse : B.
Ce sont les composants substantiels, non la décoration, qui pilotent la qualité. A est faux. C ignore l’effet bien établi de la structure du prompt. D surcorrige en une règle absolue qui n’est pas le propos.
Selon une logique de placement de l’information, quelles DEUX affirmations concernant un document de référence réutilisé sur de nombreuses conversations d’un même flux de travail sont correctes ?
Afficher la réponse
Réponse : A et B.
Un document de référence réutilisé appartient au Project, et le coller à répétition est inefficace et source d’erreurs. C détourne memory pour un document. D automatise le calendrier, non l’accès au document. E nie la réutilisation qu’un Project fournit explicitement.
Un utilisateur veut qu’une petite préférence permanente s’applique à toutes les futures conversations sans la retaper, et demande comment se comporte memory. Quelle affirmation est la MOST accurate ?
Afficher la réponse
Réponse : B.
Memory conserve de petites préférences stables d’une conversation à l’autre et est gérable par l’utilisateur. A surestime sa portée. C confond memory avec l’entraînement. D contredit sa persistance entre conversations.
Une conversation interminable gardée ouverte pour ne rien perdre produit des réponses plus vagues et plus lentes. Que se passe-t-il et quelle est la BEST correction ?
Afficher la réponse
Réponse : B.
Un contexte engorgé et vieillissant dégrade la qualité ; résumer l’essentiel et redémarrer restaure le focus. A abandonne inutilement. C confond la coupure d’entraînement avec le contexte. D invente une cause de capacité de memory.
Une contrainte ponctuelle qui ne s’applique qu’au livrable en cours ne cesse d’être enregistrée dans memory, de sorte qu’elle affecte à tort des conversations ultérieures sans rapport. Quels sont la correction et le principe ?
Afficher la réponse
Réponse : B.
Les instructions ponctuelles relèvent du prompt ; seules les préférences stables relèvent de memory. A provoque exactement le débordement signalé. C la sur-appliquerait encore à toutes les conversations du Project. D est une réaction excessive qui écarte des préférences stables utiles.
Un consultant gère trois clients et a besoin que les préférences et fichiers de chaque client restent strictement séparés avec le LEAST effort continu. Quelle est la BEST structure ?
Afficher la réponse
Réponse : B.
Un Project par client garde les contextes proprement séparés avec peu d’effort continu. A risque une contamination croisée. C mélange les clients dans memory. D demande beaucoup d’effort et est source d’erreurs à chaque session.
Sélectionnez les DEUX pratiques qui maintiennent le mieux un contexte propre sur une semaine de travaux variés.
Afficher la réponse
Réponse : A et B.
Des conversations neuves par sujet et l’usage approprié des Projects et de memory gardent le contexte propre. C encombre chaque conversation. D provoque dérive et dilution. E stocke des données sensibles là où elles ne devraient pas résider.
Un dossier de conseil d’administration est dû dans une heure ; il se lit avec fluidité, mais deux lignes de sous-totaux ne correspondent pas au total global et une citation est introuvable. Que devriez-vous faire FIRST ?
Afficher la réponse
Réponse : B.
Les ruptures de cohérence interne et de citation sont des problèmes bloquants ; corrigez d’abord les chiffres et la source. A livre des erreurs connues. C fait confiance à la source faillible. D dissimule le problème au lieu de le résoudre.
Un analyste valide l’affirmation d’un résumé selon laquelle le délai de préavis d’un contrat est de 60 jours. Le contrat a été téléversé. Qu’est-ce qui le valide le plus adéquatement ?
Afficher la réponse
Réponse : B.
Ancrer l’affirmation signifie lire la clause réelle dans le document source. A fait trop confiance à un résumé qui peut se tromper de lecture. C réutilise le générateur faillible. D compare à un document non pertinent plutôt qu’à la source.
Un tableau de bord indique 92 % d’exactitude sur une tâche d’étiquetage assistée par IA et un manager veut la passer à l’échelle. Qu’est-ce qui compte le plus à vérifier FIRST avant l’extension ?
Afficher la réponse
Réponse : B.
L’exactitude agrégée peut masquer des schémas d’erreurs coûteux, donc la répartition des erreurs et leur impact comptent le plus en premier. A ignore où tombent les 8 %. C est cosmétique. D s’appuie sur la confiance, qui n’est pas un signal d’exactitude.
Pour un nombre que le modèle a CALCULÉ à partir de données que vous avez fournies, quelle action de validation correspond correctement à sa provenance ?
Afficher la réponse
Réponse : B.
Un chiffre calculé se valide par un recalcul indépendant, ce qui correspond à sa provenance. A convient aux faits de source externe, non aux chiffres calculés. C s’applique aux affirmations citées. D recourt à un autre générateur faillible plutôt que de recalculer.
Un chercheur dispose d’un résumé avec huit citations et de peu de temps. Quel est le tri le MOST effective pour détecter d’abord une fabrication ?
Afficher la réponse
Réponse : B.
Vérifier les affirmations qui comptent le plus, puis escalader si l’une est fabriquée, est un tri efficace. A suppose que la quantité implique la fiabilité. C vérifie le style, non la vérité. D s’appuie sur la source qui les a produites.
Sélectionnez les DEUX étapes de vérification qui sont GRATUITES et ne nécessitent AUCUNE source externe.
Afficher la réponse
Réponse : A et B.
Les contrôles de pertinence et de cohérence interne ne nécessitent que la sortie elle-même. C, D et E exigent chacun une source externe faisant autorité et ne sont donc ni gratuits ni indépendants d’une source.
Sélectionnez les DEUX pratiques qui sont des contrôles faibles et ne vérifient PAS réellement l’exactitude.
Afficher la réponse
Réponse : A et B.
La confiance auto-déclarée et la concordance entre modèles ne sont pas un ancrage et peuvent se tromper avec assurance. C, D et E sont une véritable vérification par rapport à une source ou par calcul indépendant, ce sont donc des contrôles forts, non faibles.
Un collègue soutient qu’une prévision strictement interne n’a pas besoin de vérification car elle ne sera pas publiée. La prévision fixera le budget de l’an prochain. Quelle est la BEST réponse ?
Afficher la réponse
Réponse : B.
La rigueur croît avec la conséquence, et une prévision qui fixe un budget est à fort enjeu, indépendamment de la publication. A et C lient à tort le contrôle à l’audience ou à l’autorité. D réutilise le même générateur faillible au lieu de vérifier.
Une sortie sur laquelle vous allez agir est longue et se lit avec fluidité. En appliquant une approche de vérification ordonnée par coût, quel contrôle vient FIRST ?
Afficher la réponse
Réponse : B.
Commencer par le contrôle le moins cher et le plus rapide qui détecte les erreurs évidentes, puis escalader au besoin. A et C sont des étapes lourdes ultérieures. D n’est pas du tout une étape de vérification et gaspille de l’effort avant de contrôler la justesse.
Une politique d’entreprise désigne un espace de travail Enterprise comme le SEUL endroit approuvé pour les données confidentielles, mais un compte personnel est plus rapide aujourd’hui. Un employé est sous pression de délai. Que devrait-il faire ?
Afficher la réponse
Réponse : B.
Les données confidentielles doivent rester dans l’espace de travail approuvé quelle que soit la pression de délai. A viole la politique et risque l’exposition. C expose tout de même des données sur un compte non approuvé. D délègue une décision de gouvernance au modèle.
Une comparaison de fournisseurs produite par le modèle liste de nombreux avantages pour l’Option A et surtout des inconvénients pour l’Option B, correspondant à la façon dont l’utilisateur a cadré la demande. Quel est le problème et la BEST correction ?
Afficher la réponse
Réponse : B.
Le résultat déséquilibré reflète un cadrage biaisé plus la flagornerie ; une redemande neutre et équilibrée le corrige. A ignore le biais. C traite des faits fabriqués, non le déséquilibre. D traite la dérive des longues conversations, qui n’est pas la cause ici.
Quand la divulgation de l’assistance par IA est-elle le plus clairement attendue ?
Afficher la réponse
Réponse : B.
La divulgation est attendue là où les règles ou normes du contexte l’exigent, comme dans les cadres académiques ou réglementés. A est privé et à faible enjeu. C ignore les normes de divulgation réelles. D lie la divulgation à la justesse, ce qui n’est pas le critère.
Une sortie de modèle adopte par défaut des hypothèses de rôle genrées, présentant l’ingénieur comme un homme et l’assistante comme une femme. De quoi s’agit-il et quelle est la FIRST réponse correcte ?
Afficher la réponse
Réponse : B.
Les rôles genrés par défaut sont une forme de biais à corriger et à surveiller. A écarte un véritable problème d’équité. C classe à tort le biais comme une fabrication. D est sans rapport avec la manière dont le biais survient.
Un enseignant rédige un quiz avec ChatGPT pour l’utiliser avec des élèves la semaine prochaine. Quelle étape d’usage responsable est la MOST essential avant de l’utiliser ?
Afficher la réponse
Réponse : B.
Un contenu pédagogique rédigé par IA doit être vérifié quant à sa justesse, aux biais et à son adéquation avant usage avec les élèves. A fait trop confiance à un brouillon. C s’appuie sur la même source faillible. D expose d’abord les élèves à des erreurs non revues.
Sélectionnez les DEUX sorties qui exigent le plus clairement un point de revue humaine obligatoire avant d’agir.
Afficher la réponse
Réponse : A et B.
Une clause de non-responsabilité juridique publiée et un rejet de candidature sont à fort enjeu et lourds de conséquences, nécessitant une revue humaine. C, D et E sont à faibles enjeux et facilement réversibles, ils ne requièrent donc pas de point de contrôle formel.
Un utilisateur insiste sur le fait que le modèle doit avoir raison parce qu’il a répondu instantanément et n’a jamais dit qu’il n’était pas sûr. Quelle est la réponse la MOST accurate ?
Afficher la réponse
Réponse : B.
La confiance et la vitesse ne sont pas des signaux d’exactitude ; le modèle peut se tromper avec fluidité sans nuancer. A prend des indices de surface pour une preuve. C est faux ; les modèles ne signalent souvent pas l’incertitude. D invente une source de consultation vérifiée qui n’existe pas.
Un utilisateur a besoin d’un assistant d’équipe réutilisable qui applique toujours une checklist de revue fixe ET peut être partagé, tandis qu’une question ponctuelle distincte nécessite le taux de change du jour. Quel appariement est correct ?
Afficher la réponse
Réponse : A.
Un custom GPT empaquette un assistant réutilisable et partageable et Search récupère un taux récent. B détourne memory et la génération d’images. C utilise un planificateur et une recherche lourde pour les mauvais besoins. D est une surface d’édition pour aucune des deux tâches.
Un utilisateur a besoin qu’une petite préférence personnelle stable s’applique partout, qu’un unique rapport de 25 pages soit résumé une fois, et que les règles de marque permanentes d’un client soient partagées avec une équipe. Quelle correspondance est correcte ?
Afficher la réponse
Réponse : A.
Les petites préférences stables conviennent à memory, un document unique convient à un import de fichier, et des règles permanentes partagées conviennent à un Project partagé. B place mal chaque élément. C surcharge memory avec un document et des règles partagées. D s’appuie sur une conversation unique qui se dégrade.
Dernière mise à jour le 18 sept. 2026