Qu'est-ce que la "pensée étendue" (extended thinking) chez Claude ?	C'est une fonctionnalité qui donne à Claude le temps de raisonner sur la requête de l'utilisateur avant de générer une réponse finale.
Quels sont les principaux compromis (trade-offs) liés à l'activation de la pensée étendue ?	Augmentation du coût (tokens générés pendant la phase de réflexion) et augmentation de la latence.
Quand doit-on envisager d'activer la pensée étendue ?	Lorsque l'exactitude d'un prompt n'est pas satisfaisante après avoir fait des efforts pour l'améliorer (en se basant sur les évaluations de prompt).
Quel nouveau type de bloc apparaît dans la réponse lorsque la pensée étendue est activée ?	Un "thinking block" (bloc de pensée), qui contient le texte généré pendant le processus de réflexion de Claude.
Quel est le rôle de la "signature" (signature) dans un bloc de pensée ?	C'est un jeton cryptographique qui garantit que le texte du bloc de pensée n'a pas été modifié.
Que représente le contenu "redacted" (réduit) dans un bloc de pensée ?	C'est le texte de réflexion réel de Claude qui a été signalé par un système de sécurité interne, mais qui est fourni sous une forme chiffrée.
Quel est le rôle du "thinking budget" (budget de pensée) ?	Il spécifie le nombre de tokens que Claude est autorisé à utiliser pour générer sa portion de réflexion.
Quelle relation doit exister entre le "max tokens" et le "thinking budget" ?	Le "max tokens" doit être strictement supérieur au "thinking budget" (par exemple, si le budget est 1024, le max tokens doit être au moins 1025).
Comment peut-on forcer Claude à renvoyer un bloc de pensée "redacted" à des fins de test ?	En envoyant une chaîne de caractères spécialement formatée, comme "anthropic magic string triggered redacted thinking".
