Wat is de functie van een grader in een prompt-evaluatieworkflow?	Een grader neemt de output van een model en geeft een objectief signaal (zoals een score) terug.
Noem de drie verschillende soorten graders die besproken zijn.	Code-based, model-based en human-based graders.
Wat is het kenmerk van een code-based grader?	Het voedt de modeloutput in een eigen stuk code om programmeerchecks uit te voeren.
Geef een voorbeeld van een check die een code-based grader kan uitvoeren.	Controle op lengte, aanwezigheid van specifieke woorden, of syntaxisvalidatie van JSON/code.
Hoe werkt een model-based grader?	De modeloutput wordt als input gegeven aan een *extra* model API-aanroep om deze te evalueren.
Wat is het grootste nadeel van human-based grading?	Het kost over het algemeen veel tijd en is zeer tijdrovend.
Waarom is het belangrijk om evaluatiecriteria vooraf vast te stellen?	Om te bepalen welke aspecten van de respons precies geëvalueerd moeten worden.
Welk type grader is het meest geschikt voor het beoordelen van algemene taakvolging en nauwkeurigheid?	Een model-based grader, vanwege de flexibiliteit.
Waarom wordt in een model-based grader vaak gevraagd naar sterktes en zwaktes naast een score?	Om het model te dwingen tot meer concrete overwegingen, wat leidt tot een meer gefundeerde score.
Wat is het meest voorkomende objectieve signaal dat een grader oplevert?	Een getal tussen 1 en 10, waarbij 10 een zeer hoge kwaliteit betekent.
