Wat is een 'test case' in de context van deze workflow?	Een individueel record uit de dataset.
Wat is het primaire doel van de functie `run prompt`?	Een test case samenvoegen met de taak, tekst genereren met Claude, en het resultaat retourneren.
Wat is de functie van de `run test case` functie?	Het aanroepen van `run prompt`, het beoordelen (graden) van het resultaat, en het retourneren van een samenvattende dictionary.
Wat is de rol van de `run eval` functie?	Het laden van de volledige dataset, het itereren over elke test case, en het verzamelen van alle resultaten.
Wat is een huidige tekort aan de initiële prompt-implementatie?	Het ontbreken van formatie-instructies (zoals JSON of Python), waardoor de output vaak ongestructureerd is.
Wat is de laatste essentiële stap die nog moet worden toegevoegd aan de evaluatie-pipeline?	De grader.
