Qu'est-ce que la "pensée étendue" (extended thinking) de Claude ?	C'est une fonctionnalité qui permet à Claude de raisonner sur une requête avant de générer une réponse finale.
Quels sont les principaux compromis (trade-offs) liés à l'activation de la pensée étendue ?	Augmentation du coût (tokens de réflexion) et augmentation de la latence.
Quand devrait-on envisager d'activer la pensée étendue ?	Lorsque l'exactitude d'un prompt n'est pas satisfaisante après des évaluations (prompt evals).
Quel nouveau type de bloc apparaît dans la réponse lorsque la pensée étendue est activée ?	Le "thinking block" (bloc de pensée).
Quel est le rôle de la "signature" dans un thinking block ?	C'est un jeton cryptographique qui garantit que le texte de réflexion n'a pas été modifié.
Qu'est-ce qu'un contenu "redacted" (censuré) dans un thinking block ?	C'est le texte de réflexion qui a été signalé par un système de sécurité interne et est fourni sous forme chiffrée.
Quelle est la relation entre le "thinking budget" et le "max tokens" ?	Le "max tokens" doit être strictement supérieur au "thinking budget".
Quels arguments sont utilisés pour configurer la pensée étendue dans la fonction de chat ?	`thinking` (pour l'activation) et `thinking_budget` (pour définir le nombre de tokens de réflexion).
