Claude Certified Associate Foundations Prep Course
← Toutes les leçons
Leçon 03Claude Certified Associate Foundations Prep Course

Évaluation et validation de la sortie de Claude

Audio récapitulatif

Pas de récapitulatif audio pour cette leçon.

Notes de cours

Screen 1 : Évaluation et validation de la sortie de Claude

Module 3Introduction·4 min

Claude vous a fait gagner vingt minutes en rédigeant une analyse. Un seul chiffre fabriqué dans cette analyse, envoyé à un client ou à un régulateur, peut coûter bien plus que vingt minutes à corriger.

C'est l'asymétrie au cœur de l'utilisation professionnelle de l'IA : le temps économisé est petit et visible, et le coût d'une erreur non vérifiée est grand et arrive plus tard.

C'est la plus grande section de l'examen de certification, et la raison en est la responsabilité. Quand vous mettez votre nom sur un livrable, vous êtes responsable de chaque affirmation qu'il contient, que vous ayez écrit les mots ou que Claude l'ait fait. Ce module vous donne la discipline pour défendre le travail assisté par l'IA.

Un consultant a demandé à Claude de récupérer des statistiques de soutien pour un deck de dimensionnement de marché client. Claude a retourné cinq chiffres clairs avec un encadrement confiant. Quatre étaient solides. Un, un taux de croissance, était fabriqué, assez plausible pour que personne ne le remette en question. Les chiffres sont allés dans un deck, le deck est allé à un client, et l'analyste du client a signalé le chiffre fabriqué dans la salle.

Les dix minutes économisées sur la recherche ont coûté un coup à la crédibilité et une semaine de reconstruction de la confiance. Rien dans le chiffre ne semblait mal à l'écran. C'est le problème que ce module est destiné à résoudre : le coût d'une erreur manquée n'est pas payé quand vous économisez le temps, il est payé plus tard, par quelqu'un dont vous aviez besoin de la confiance.

Deux compétences du cadre de maîtrise de l'IA ancrent le module. Le discernement est la compétence d'évaluer critiquement la sortie par rapport aux exigences, aux sources et aux normes. La diligence consiste à décider quand la vérification est requise et à assumer la responsabilité du résultat. Le discernement est la façon dont vous examinez ; la diligence est la raison pour laquelle vous devez le faire.

À la fin de ce module, vous serez capable de :

  • 1Évaluer la sortie générée par Claude pour l'exactitude et l'exhaustivité.
  • 2Identifier les hallucinations, les incohérences et les biais dans les réponses.
  • 3Appliquer des techniques de vérification des faits et de validation.
  • 4Déterminer quand un examen humain ou une vérification supplémentaire est requise.
  • 5Éditer, adapter, affiner et comparer la sortie pour le public visé.
  • 6Sélectionner les formats de sortie appropriés et organiser les informations pour des résultats optimaux.

L'accord dans ce module

Vous êtes responsable de tout ce que vous livrez, créé avec l'aide de Claude. Apprenez à évaluer la sortie systématiquement, reconnaître les modèles d'échec, intégrer la vérification dans vos prompts, connaître les seuils où l'examen humain est obligatoire, et choisir le format de sortie qui correspond à la fiabilité que la tâche exige.

Nous avons construit ce cours Associate Module 3 : Évaluation et validation de la sortie de Claude pour vous aider à accomplir un vrai travail avec Claude. Traitez-le comme du contenu éducatif. Il ne constitue pas un conseil juridique, financier ou autre conseil professionnel, alors adaptez ce que vous apprenez à votre situation. Nos produits et services évoluent rapidement, donc certains contenus peuvent contenir des erreurs ou être obsolètes ; n'oubliez pas de vérifier sur le site Web ou la documentation d'Anthropic. Les exemples et scénarios utilisés dans le cours sont illustratifs et souvent fictifs. Si le matériel du cours mentionne une entreprise ou un produit, cela ne signifie pas qu'Anthropic les approuve, qu'ils approuvent Anthropic, ou que nous sommes affiliés. Notez également que votre utilisation des produits et services d'Anthropic est couverte par nos conditions, politiques et documentation ; si quelque chose dans ce cours entre en conflit avec eux, ils contrôlent.

---

Screen 2 : Discernement : Évaluation de l'exactitude, de l'exhaustivité et de l'adéquation

TeachingDiscernment·12 min

L'évaluation n'est pas une impression sur le fait que la sortie semble bonne. C'est une vérification par rapport à trois références fixes : les exigences que vous avez définies, le matériel source et les normes professionnelles de votre domaine. Le protocole de discernement consiste à exécuter cette vérification de la même manière à chaque fois, de sorte que la qualité ne dépend pas de votre niveau de précipitation.

Trois références d'évaluation

Exigences. La sortie reflète-t-elle ce que vous avez demandé ? Relisez votre propre demande et confirmez que chaque partie est traitée, pas seulement les parties faciles.

Matériel source. Là où la sortie s'appuie sur des documents que vous avez fournis, correspond-elle à ceux-ci ? Tracez les affirmations spécifiques jusqu'à la source plutôt que de faire confiance au fait que Claude a lu attentivement.

Normes professionnelles. Cela passerait-il dans votre domaine ? Un nombre sans unités, une recommandation sans raisonnement, une citation que vous ne pouvez pas localiser. Ceux-ci ne respectent pas les normes professionnelles même s'ils se lisent couramment.

Calibrage des enjeux

La profondeur de votre examen dépend des enjeux, et les enjeux dépendent du domaine, pas universels. Dans le travail à tolérance zéro (analyse juridique, chiffres financiers, rapports de conformité), l'exactitude prime entièrement sur la vitesse, et chaque affirmation est vérifiée. Dans le brainstorming interne à faibles enjeux, un examen plus léger est approprié. Le risque est d'appliquer le même examen désinvolte aux deux. Déterminez les enjeux avant de décider de la profondeur de l'examen.

Un triage à trois voies

Après examen, classez chaque sortie dans l'un des trois états, avec un raisonnement documenté :

Verdict

Quand cela s'applique

Prêt à utiliser

Respecte les exigences, correspond aux sources, respecte les normes professionnelles. Livrez-le.

Nécessite une révision

Proche, mais un écart spécifique demeure. Notez l'écart et itérez.

Nécessite un remplacement humain

Les enjeux, les erreurs ou l'incertitude signifient que cela ne devrait pas sortir sur le seul brouillon de Claude. Escaladez à une personne.

L'exhaustivité est un examen séparé

L'exactitude demande si ce qui est présent est correct. L'exhaustivité demande si quelque chose manque. Ils échouent indépendamment : une sortie peut être entièrement exacte et omettre quand même le seul facteur qui impacte une décision. Examinez les deux. Les éléments manquants sont plus difficiles à repérer que les mauvais, car rien à l'écran n'attire votre attention sur eux.

Le protocole sur trois sorties réelles

Le protocole est plus efficace sur les sorties qui ne sont pas évidemment bonnes ou mauvaises. Le voici appliqué à trois, chacune avec un verdict différent.

Sortie 1 : un résumé de tarification concurrente. Vous avez demandé à Claude de résumer la tarification publiée de trois concurrents à partir de PDF que vous avez téléchargés. Le résumé est propre et bien organisé. En exécutant les trois références : exigences respectées (il couvre les trois concurrents), mais l'examen des sources échoue : un prix est listé comme « 40 $/utilisateur » alors que le PDF téléchargé dit « 40 $/utilisateur, minimum 10 sièges ». L'omission change la comparaison. Verdict : nécessite une révision. La correction est un re-prompt restreint à la source, pas une réécriture.

Sortie 2 : une recommandation de processus interne. Vous avez demandé trois options pour réduire le temps de traitement des factures. La sortie donne trois options sensées avec des compromis. Exigences respectées, pas de sources à vérifier, normes professionnelles respectées, enjeux faibles (discussion interne de démarrage). Verdict : prêt à utiliser. Sur-vérifier celui-ci gaspille le temps que l'outil a économisé.

Sortie 3 : une analyse des lacunes de conformité. Vous avez demandé à Claude de comparer votre politique de traitement des données par rapport à une réglementation et de signaler les lacunes. Il signale quatre lacunes avec confiance. Les exigences semblent respectées, mais la réglementation n'a pas été téléchargée, donc Claude a travaillé à partir du rappel des données d'entraînement d'une règle qui peut avoir changé, et les enjeux sont réglementaires. Verdict : nécessite un remplacement humain. La sortie est un prompt utile pour un expert en conformité, pas un substitut à un.

Même protocole, trois verdicts. La différence n'est jamais la façon dont la sortie semble polie ; c'est ce que les trois références et les enjeux retournent.

---

Screen 3 : Hallucinations, incohérences et biais

TeachingFailure Patterns·10 min

Plausible n'est pas la même chose que vérifiée. Claude écrit couramment qu'il ait raison ou tort, donc vous ne pouvez pas compter sur le ton ou la confiance pour signaler une erreur.

Connaître les signatures spécifiques de l'échec vous permet de les repérer rapidement au lieu de lire chaque ligne avec une égale suspicion.

Modèles d'hallucination

Affirmations plausibles mais non soutenues. Une déclaration qui semble raisonnable et s'adapte au sujet, sans base dans la source ou dans les faits. Le type le plus dangereux, car rien ne semble mal.

Spécificités fabriquées. Statistiques inventées, dates, noms, citations ou citations. La spécificité se lit comme une autorité, ce qui est exactement pourquoi les spécificités fabriquées sont persuasives.

Ton confiant masquant l'incertitude. Claude se couvre rarement proportionnellement à sa certitude réelle. Une supposition et un fait bien fondé arrivent dans la même voix assurée.

Incohérences et biais

Contradictions internes. Dans une sortie longue, une affirmation au début peut entrer en conflit avec une plus tard. Les longs documents sont où les contradictions se cachent, car vous ne tenez rarement le tout en vue à la fois.

Biais de confirmation dans l'encadrement. Si votre prompt implique une réponse préférée, Claude peut pencher vers elle. Regardez la sortie qui vous met d'accord un peu trop facilement sur une question qui devrait être véritablement ouverte.

Un modèle de champ courant et anonymisé : un professionnel demande à Claude de comparer un lot de documents et d'identifier les différences. La sortie énumère plusieurs différences et se lit comme complète. Elle a manqué les différences dans le seul fichier le plus important du lot. Les défaillances d'exhaustivité se concentrent où l'attention est la plus faible, et un résumé confiant des fichiers faciles peut masquer le silence sur le difficile.

Claude peut prétendre avoir pris une action qu'il ne peut pas réellement prendre, comme « J'ai envoyé cela à votre équipe » ou « J'ai enregistré le fichier ». Dans claude. ai, Claude fonctionne avec la conversation, les outils connectés et les fichiers téléchargés ; il n'effectue pas d'actions externes pour lesquelles il n'a pas reçu un outil. Traitez toute action externe revendiquée comme non vérifiée jusqu'à ce que vous confirmiez qu'elle s'est produite.

Une galerie de modèles d'échec

Chaque modèle ci-dessous est montré de la façon dont il peut réellement apparaître, afin que vous reconnaissiez la signature plutôt que l'étiquette.

Prompt : « Quelle part des entreprises SaaS de marché intermédiaire ont adopté des outils d'IA en 2025 ? » Sortie : « Environ 63 pour cent des entreprises SaaS de marché intermédiaire ont adopté au moins un outil d'IA en 2025, contre 41 pour cent en 2024. » Les chiffres sont précis, la tendance est plausible, et il n'y a pas de source. La précision est le signal. Les chiffres réels aussi spécifiques viennent avec une citation ; un 63 pour cent sans citation est une supposition en forme de nombre.

Prompt : « Cette clause est-elle exécutoire dans notre État ? » Sortie : une réponse de quatre phrases déclarant qu'elle est exécutoire, dans la même voix assurée que Claude utilise pour l'arithmétique. L'exécutabilité juridique est spécifique à la juridiction et sensible à la date, exactement le type d'affirmation qui devrait se couvrir et ne le fait pas. L'assurance n'est pas une preuve.

Dans une analyse de marché de dix pages, la page deux déclare que le marché adressable est « environ 2 milliards de dollars » et la page huit construit une projection sur « le marché de 2,6 milliards de dollars ». Les deux se lisent bien isolément. La contradiction ne devient visible que si vous tenez le document entier en vue, ce qui est pourquoi les sorties longues ont besoin d'une passe de cohérence, pas seulement une lecture paragraphe par paragraphe.

Aucune de ces sorties ne semble cassée. C'est le point de la leçon : les modes d'échec sont conçus, par la nature de la génération courante, pour passer un examen désinvolte. Vous les attrapez en connaissant les signatures et en vérifiant par rapport aux sources, pas en attendant que quelque chose semble mal.

---

Screen 4 : Techniques de vérification des faits et d'ancrage

TeachingFact-Checking & Grounding·10 min

La vérification la plus forte est intégrée au prompt, avant que la sortie n'existe.

Quelques habitudes de prompt réduisent les hallucinations à la source plutôt que de les attraper après coup, et elles rendent tout ce qui reste bien plus facile à auditer.

Permettez « Je ne sais pas. » Dites explicitement à Claude que reconnaître l'incertitude est acceptable. Sans cette permission, un modèle sous pression pour répondre est plus susceptible de combler le vide avec quelque chose d'inventé.

Restreignez aux sources fournies. Pour le travail sur document, instruisez Claude de répondre uniquement à partir des matériaux que vous avez fournis et de signaler tout ce que ces matériaux ne couvrent pas. Cela convertit la génération ouverte en récupération délimitée.

Exigez des citations auditables. Demandez la source spécifique et l'emplacement derrière chaque affirmation, sous une forme que vous pouvez vérifier. Une citation que vous ne pouvez pas tracer n'est pas une citation.

Citez d'abord, puis analysez. Pour les longs documents, demandez à Claude d'extraire les citations de soutien avant de tirer des conclusions. Ancrer l'analyse dans les citations extraites rend à la fois le raisonnement et les erreurs visibles.

Comparaison du meilleur des N. Réexécutez la même demande et comparez. Là où les exécutions s'accordent, la confiance augmente ; là où elles divergent, vous avez trouvé les points faibles qui ont besoin d'un regard humain.

Validez par rapport aux sources faisant autorité. Pour les affirmations qui comptent, vérifiez par rapport à une référence externe de confiance plutôt qu'une deuxième réponse de Claude. Les aides intégrées au produit aident ici : Claude for Excel peut produire des citations au niveau des cellules qui lient les chiffres à leurs entrées.

Les techniques comme prompts verbatim

Chaque technique est une phrase que vous pouvez coller. La formulation est la compétence.

Permission de ne pas savoir

« Si la réponse n'est pas soutenue par les documents que j'ai fournis, dites-le explicitement plutôt que d'estimer. Il est acceptable de répondre « les matériaux fournis ne couvrent pas cela. »

Restriction de source

« Répondez en utilisant uniquement le contrat joint. N'utilisez pas les connaissances générales. Pour tout ce que le contrat ne couvre pas, énumérez-le sous « Non couvert par ce document. »

Citation auditable

« Pour chaque affirmation, citez le numéro de section et de clause d'où elle provient, entre parenthèses, afin que je puisse la vérifier par rapport à la source. »

Ancrage par citation

« Avant d'analyser, extrayez les phrases exactes du document qui se rapportent à ma question. Ensuite, basez votre analyse uniquement sur ces citations. »

Avant de compter sur une sortie : ai-je permis l'incertitude, restreint aux sources le cas échéant, exigé des citations que je peux auditer, et vérifié les affirmations à enjeux élevés par rapport à quelque chose d'autorisé ? Intégrer ceux-ci au prompt est moins cher que de reconstruire la confiance dans la sortie après coup.

---

Screen 5 : Diligence : Quand l'examen humain est non-négociable

TeachingDiligence·10 min

Certaines sorties ne doivent jamais sortir comme un brouillon de Claude seul, peu importe leur apparence.

La diligence signifie connaître ces seuils à l'avance, de sorte que la décision d'escalader est prise par politique, pas au moment après que quelque chose s'est déjà mal passé.

Quatre seuils de risque

Seuil

Quoi demander

Enjeux

Quel est le coût si c'est mal ? Les erreurs à coût élevé exigent un examen humain indépendamment de la confiance que la sortie semble avoir.

Réversibilité

L'action peut-elle être annulée ? Une étape irréversible (un livrable client envoyé, un rapport déposé) franchit une barre plus élevée qu'un brouillon que vous pouvez réviser.

Public

Qui le voit ? Les publics externes, exécutifs et réglementaires augmentent l'exigence d'examen au-dessus des brouillons de travail internes.

Exposition réglementaire

Une règle, un contrat ou une loi gouverne-t-elle cela ? Le contenu réglementé porte des obligations que l'assistance de l'IA ne supprime pas.

La liste ne pas livrer sans examen

Décidez ceux-ci à l'avance et traitez-les comme fixes :

  • Livrables clients finaux
  • Calculs critiques pour l'audit ou matériellement financiers
  • Tout ce qui implique des données réglementées, confidentielles ou hautement sensibles
  • Communications publiques ou juridiques où une déclaration inexacte porte une conséquence durable

Itération par rapport à escalade

L'itération productive améliore la sortie à chaque tour. Quand les tours cessent de l'améliorer, vous avez des rendements décroissants, et le bon mouvement n'est pas un autre prompt ; c'est un expert humain. Reconnaître cette ligne fait partie de la diligence : plus de prompting ne peut pas fabriquer le jugement que la situation exige.

La responsabilité ne se transfère pas à l'outil. Le travail produit avec Claude est votre travail quand vous le livrez, et la norme professionnelle est la même que si vous l'aviez produit sans aide. La diligence est l'habitude d'agir comme si c'était vrai, car c'est le cas.

Trois scénarios d'escalade

Le rapide « oui. » Claude rédige un agenda de réunion interne. Enjeux faibles, réversible, public interne, pas d'exposition réglementaire. Les quatre seuils disent livrez. Pas d'escalade ; c'est le cas de routine sur lequel vous pouvez vous déplacer rapidement.

Le trompeur « semble bien. » Claude produit un résumé financier de deck de conseil qui se lit proprement. Les enjeux sont élevés, il y a un public exécutif, et le résultat sera partiellement irréversible une fois présenté, déclenchant trois des seuils de risque. L'apparence propre est hors de propos ; cela va à un examinateur humain et les chiffres sont recalculés avec l'exécution de code.

La lente progression. Vous avez itéré une proposition client cinq fois. Les tours trois à cinq ont presque rien changé. Rendements décroissants plus un livrable externe à enjeux élevés : arrêtez de faire des prompts, escaladez à un collègue pour une lecture nouvelle. Le signal d'escalade est la courbe d'amélioration plate, pas une erreur visible.

---

Screen 6 : Édition et adaptation de la sortie pour votre public

TeachingEditing for Audience·8 min

Claude rédige ; vous livrez. L'écart entre un brouillon brut et un livrable fini est la passe d'édition, et c'est dans cette passe que vos normes professionnelles et votre connaissance du public s'appliquent. Un brouillon qui est exact n'est toujours pas fini.

Du brouillon brut au livrable

Trois passes transforment un brouillon en quelque chose sur lequel vous mettriez votre nom :

Clarté. Coupez les couvertures, resserrez les phrases lâches, supprimez tout ce qui ne gagne pas sa place. Claude tend vers la complétude ; l'édition tend vers la précision.

Ton. Faites correspondre le registre à la relation et à l'occasion. Le même contenu se lit différemment pour un pair, un client et un régulateur.

Formatage. Façonnez la sortie pour la façon dont elle sera lue : scannable pour un exécutif, détaillée pour une équipe de travail, propre pour un destinataire externe.

Calibrage du public

Une analyse a souvent besoin de devenir plusieurs livrables. Un résumé exécutif commence par la décision et l'impact. Une version d'équipe de travail garde le détail et la méthode. Une communication externe contrôle ce qui est divulgué et comment il est encadré. Les faits sous-jacents restent stables ; la sélection, la profondeur et le ton changent avec qui lit.

Comparaison des sorties avant édition

Quand la qualité compte, générez plus d'un brouillon (entre les exécutions ou entre les modèles) et choisissez la base la plus forte à éditer, plutôt que de vous engager sur la première réponse. Comparer les candidats est moins cher que de sauver un brouillon faible, et cela invite un encadrement que vous n'auriez peut-être pas demandé.

Une analyse, deux publics : une transformation

« L'analyse indique que le temps de traitement a augmenté d'environ 18 pour cent au Q3, ce qui peut être attribuable à une combinaison d'un volume plus élevé et de l'intégration de trois nouveaux membres du personnel qui étaient toujours en intégration pendant la période, et il est recommandé que l'équipe considère si une documentation de processus supplémentaire pourrait aider à atténuer des effets similaires dans les futurs cycles d'intégration. »

« Le temps de traitement du Q3 a augmenté de 18 pour cent, entraîné par le volume plus trois nouvelles recrues en intégration. Recommandez des documents d'intégration standardisés pour limiter l'effet la prochaine fois. » Commence par le nombre et la décision ; une phrase.

« Le temps de traitement était en hausse ~18% au Q3. Deux moteurs : volume plus élevé et trois nouveaux membres du personnel toujours en intégration. Action : rédiger une documentation d'intégration pour que la prochaine cohorte monte plus vite (propriétaire et calendrier à confirmer en standup). » Garde la méthode et ajoute l'étape opérationnelle suivante.

Mêmes faits, même 18 pour cent. La coupe exécutive supprime la méthode et commence par l'impact ; la coupe de travail garde le détail et assigne l'action. Aucun n'est un brouillon brut, qui ne servirait aucun des deux publics.

---

Screen 7 : Choix des formats de sortie : Inline, Artifacts, Structurés, Code-Exécutés

TeachingOutput Formats·8 min

Le format de sortie est une décision de fiabilité, pas seulement un choix de présentation. Le bon format dépend de ce pour quoi le résultat est destiné et, surtout, de la confiance que les chiffres doivent avoir.

Format par objectif

  • Inline. Pour les réponses conversationnelles sur lesquelles vous agirez dans le chat. Rapide, contextuel, pas destiné à être un artifact autonome.
  • Artifacts. Pour les documents et le code : un bloc séparé et modifiable que vous affinerez et réutiliserez. La bonne maison pour un livrable plutôt qu'une réponse.
  • Formats structurés. Pour les données : tableaux et schémas définis que les outils en aval ou les lecteurs peuvent consommer directement.

Exécution de code comme chemin de sortie vérifiée

Quand les chiffres doivent être justes, faites-les calculer par Claude plutôt que de les écrire. La génération de prose produit un chiffre plausible ; l'exécution de code exécute le calcul et retourne un résultat calculé et vérifiable, ainsi que des graphiques et des fichiers traités. Le déterminisme s'attache au calcul exécuté ; Claude écrit le code, donc la logique elle-même peut toujours contenir un bug. La garantie est que vous pouvez lire, vérifier et réexécuter le calcul, mais le code n'est pas automatiquement correct. La même tâche de données faite de deux façons montre la différence : un nombre généré en prose est une supposition en forme de réponse, tandis qu'un nombre de l'exécution de code est un résultat calculé que vous pouvez tracer et vérifier.

Prose par rapport à code-exécuté : la même tâche

Tâche : à partir d'une feuille de calcul de ventes téléchargée, rapportez le revenu total du Q3 et les trois meilleurs comptes.

Chemin prose : « Le revenu total du Q3 était d'environ 4,7 millions de dollars, les plus grands comptes étant Northwind, Contoso et Globex. » Courant, rapide et non vérifiable. Le total est la meilleure supposition du modèle pour additionner une colonne qu'il ne peut pas réellement ajouter de manière fiable, et un total erroné ici se propage dans chaque diapositive en aval.

Chemin code-exécuté : Claude écrit et exécute du code sur le fichier réel, retournant 4 712 380 $ comme somme calculée, les trois meilleurs comptes classés par leurs totaux réels, et un graphique en barres. Le nombre est traçable aux lignes qui l'ont produit. Quand le chiffre alimente une décision, c'est le seul chemin qui gagne la confiance.

La réponse prose n'est pas paresseuse ; c'est un type de sortie différent. Pour une vérification rapide à faibles enjeux, cela peut être bien. Pour tout ce qui est rapporté, l'exigence de fiabilité pointe vers l'exécution de code.

Organisez les entrées pour façonner la sortie

Les entrées organisées produisent des sorties organisées. Fournir du matériel source propre et bien étiqueté et énoncer la structure que vous voulez en retour est ce qui permet à Claude de retourner quelque chose de structuré plutôt que quelque chose que vous devez restructurer. La règle de sélection est simple : choisissez la modalité de sortie par la fiabilité que la tâche exige. Organiser les entrées signifie supprimer le mauvais matériel, en plus d'ajouter le bon matériel. Trois techniques font la plupart du travail : dédupliquez vos sources pour que Claude ne réconcilie pas trois copies presque identiques du même document ; étiquetez et structurez ce que vous fournissez pour que le rôle de chaque entrée soit explicite (« c'est la politique approuvée ; ce sont les réponses brouillon ») ; et élaguez le matériel qui n'est pas pertinent à la question, car le bruit dans l'entrée devient du bruit dans la sortie. Les entrées propres, bien étiquetées et minimales produisent un résultat plus propre qu'un grand tas indifférencié.

---

Screen 8 : Exercice : Triez l'ensemble de sortie

ExerciseTriage the Output Set·7 min

Le triage est le muscle quotidien de l'utilisation responsable de l'IA. Cet exercice applique le protocole de discernement et les seuils de diligence à un ensemble de sorties, comme vous le feriez dans le vrai travail.

Quatre sorties de Claude suivent. Classez chacune comme prête à utiliser, nécessite une révision ou nécessite un remplacement humain, et énoncez la raison. Ensuite, comparez par rapport aux réponses modèles.

Sorties à trier

---

Screen 9 : Variante : Évaluez votre propre conversation

OptionalSelf-Assessment·3 min

Choisissez l'une de vos récentes conversations Claude. Évaluez-la par rapport aux indicateurs comportementaux de discernement et de diligence de ce module : avez-vous vérifié la sortie avant de l'utiliser (diligence), et avez-vous jugé si la réponse correspondait réellement à la question que vous aviez posée (discernement) ? Tapez une phrase sur où vous étiez fort et une sur où vous resserreriez, puis révélez la liste de contrôle d'indicateurs pour comparer.

---

Screen 10 : Quiz du Module 3 : Évaluation et validation de la sortie

QuizModule 3·5 min

Sept questions de style scénario mettant l'accent sur les appels de jugement. Chacune présente une situation ; sélectionnez la réponse qui applique le mieux le cadre d'évaluation du module. Environ cinq minutes.

---

Screen 11 : Points clés à retenir

Module 3Key Takeaways

Six choses qui tiennent dans ce module :

La responsabilité reste avec vous.

Vous êtes responsable de chaque affirmation dans ce que vous livrez, que vous l'ayez écrite ou que Claude l'ait fait. C'est pourquoi c'est la plus grande section de l'examen.

Évaluez par rapport à trois références.

Exigences, matériel source et normes professionnelles. Exécutez la même vérification à chaque fois et calibrez la profondeur de l'examen à ce qui est en jeu.

Plausible n'est pas vérifiée.

Les spécificités fabriquées, l'incertitude confiante et les lacunes d'exhaustivité se lisent tous comme compétents. Apprenez les signes pour pouvoir les repérer rapidement.

Intégrez la vérification au prompt.

Permettez « Je ne sais pas », restreignez aux sources et exigez des citations auditables. La prévention est moins chère que la reconstruction.

Connaissez les seuils à l'avance.

Les enjeux, la réversibilité, le public et l'exposition réglementaire décident quand l'examen humain est obligatoire. Fixez la ligne avant le moment, pas après.

Choisissez le format par fiabilité.

Quand les chiffres doivent être justes, calculez-les avec l'exécution de code plutôt que de les générer en prose.

Toutes les descriptions du comportement du produit sont basées sur les fonctionnalités de claude. ai en juin 2026. La disponibilité des fonctionnalités et le comportement doivent être vérifiés par rapport à la documentation actuelle d'Anthropic à la publication :

  • AI Fluency Framework : compétences et indicateurs comportementaux de discernement et de diligence
  • Documentation Anthropic : réduction des hallucinations, citations et conseils de vérification, platform. claude. com/docs
  • Centre d'aide Claude : exécution de code et citations au niveau des cellules Claude for Excel, support. claude. com

---

Screen 12 : Félicitations ! Vous avez complété ce module avec succès.

Module CompleteAssociate Path·2 min

Vous pouvez maintenant valider la sortie de Claude et reconnaître quand l'examen humain est non-négociable. Attrapez les lacunes, et Claude devient un collaborateur de confiance, pas un passif.

M1 : Sélection du produit et du modèle

Choisissez le bon point d'entrée, modèle et fonctionnalités pour toute tâche donnée.

M2 : Prompting

Construisez des prompts structurés et adaptez-les au type de tâche.

M3 : Évaluation de la sortie

Validez la sortie et savez quand l'examen humain est non-négociable.

M4 : Intégration du flux de travail

Mappez un flux de travail par rapport aux critères de délégation et redessinez-le en toute sécurité.

M5 : Configuration

Configurez et maintenez les projets, les instructions et les connaissances.

M6 : Gouvernance

Appliquez le jugement de cas d'usage, de données, de politique et d'éthique de manière responsable.

M7 : Dépannage

Diagnostiquez les sous-performances et optimisez les flux de travail quand les résultats sont insuffisants.

M8 : Résumé du cours et prochaines étapes

Récapitulez le voyage, préparez-vous à l'examen et reconnaissez les limites d'escalade vers les pistes de développeur et d'architecte.

Cartes mémo 0 cartes

No flashcards for this lesson.

Vérification des connaissances 0 questions

No quiz for this lesson yet.