Wat is het doel van een grader in een prompt-evaluatieworkflow?	Het geven van een objectief signaal (bijv. een nummer of waar/onwaar) over de modeloutput.
Welke drie soorten graders worden besproken?	Code-based, model-based en human-based graders.
Wat is de functie van een code-based grader?	Het uitvoeren van geprogrammeerde checks op de modeloutput, zoals lengte, aanwezigheid van woorden of syntaxisvalidatie.
Hoe werkt een model-based grader?	De modeloutput wordt ingevoerd in een *extra* model (een tweede API-aanvraag) om deze te evalueren.
Wat is het grootste nadeel van human-based grading?	Het kost veel tijd en is zeer tijdrovend/monotoos.
Waarom is het belangrijk om evaluatiecriteria vooraf te bepalen?	Om te bepalen welke specifieke aspecten van de respons geëvalueerd moeten worden (bijv. formaat, syntaxis, taakvolging).
Welke grader is het meest geschikt voor het controleren van formaat en syntaxis (bijv. JSON)?	Een code-based grader.
Welke grader is het meest geschikt voor algemene taakvolging en kwaliteit?	Een model-based grader, vanwege de flexibiliteit.
Waarom moet een prompt voor een model-based grader meer vragen dan alleen een score?	Om de modeloutput te dwingen tot meer concrete beoordelingen (zoals sterktes, zwaktes en onderbouwing), wat leidt tot betere scores.
