Ist es in der Prompt-Evaluierung eine feste, einheitliche Methodik?	Nein, es gibt viele verschiedene Möglichkeiten, einen Workflow zusammenzustellen.
Warum wird ein benutzerdefinierter Workflow in einem Jupyter Notebook implementiert?	Um zu zeigen, dass man klein anfangen kann und nicht sofort eine komplexe, "heavyweight" Lösung benötigt.
Was ist der erste Schritt in einem typischen Prompt-Evaluations-Workflow?	Das Verfassen eines anfänglichen Prompt-Entwurfs (Initial Prompt Draft).
Was ist der Zweck des Evaluation Data Sets?	Es enthält eine Liste möglicher Eingaben (Inputs), die in den Prompt eingefügt werden sollen.
Was passiert nach der Erstellung des Evaluation Data Sets?	Jeder Input wird mit dem Prompt kombiniert und an das LLM (Cloud) gesendet, um eine Antwort zu erhalten.
Welcher Schritt folgt nach dem Erhalt der Antworten vom LLM?	Der Grading-Schritt, bei dem ein "Grader" die Antworten bewertet.
Wie wird die Qualität der LLM-Antworten im Grading-Schritt gemessen?	Durch eine Bewertung (z. B. auf einer Skala von 1 bis 10) durch einen Grader.
Was ist der nächste Schritt nach dem Erhalten einzelner Bewertungen?	Die Bewertungen werden gemittelt, um einen objektiven Gesamtscore für den Prompt zu erhalten.
Was macht man, wenn der Prompt-Score nicht zufriedenstellend ist?	Man iteriert, indem man den Prompt ändert und den gesamten Prozess wiederholt.
