Waarom voegen LLM's (zoals Claude) vaak ongewenste extra tekst toe bij het genereren van gestructureerde data?	Omdat ze van nature geneigd zijn om een header, footer of toelichtende commentaren toe te voegen.
Welke combinatie van technieken wordt gebruikt om alleen de ruwe, gevraagde data te ontvangen?	Stop sequences in combinatie met pre-filled assistant messages.
Wat is het hoofddoel van het gebruik van stop sequences en pre-filled assistant messages?	Om ervoor te zorgen dat het model alleen de gevraagde ruwe inhoud genereert, zonder extra commentaren of formatteertekens.
Wat is de functie van een pre-filled assistant message in dit proces?	Het vertelt het model dat het de gewenste structuur (bijv. ` ```json`) al heeft gestart en dat het nu alleen de inhoud moet invullen.
Hoe zorgt een stop sequence ervoor dat de generatie stopt?	Het stopt de generatie onmiddellijk zodra het model een vooraf gedefinieerde reeks tekens bereikt.
Is de techniek van stop sequences en pre-filled messages beperkt tot het genereren van JSON?	Nee, het kan worden gebruikt voor elk type gestructureerde data (bijv. Python, genummerde lijsten).
Wat gebeurt er in het voorbeeld wanneer de stop sequence wordt geactiveerd?	Het model stopt onmiddellijk met genereren zodra het probeert het markdown code block te sluiten (de afsluitende backticks).
