डेटा सेट जनरेशन के बाद वर्कफ़्लो में अगला चरण क्या है?	प्रत्येक रिकॉर्ड (टेस्ट केस) को प्रॉम्प्ट के साथ मर्ज करना, उसे Claude में फीड करना, और फिर ग्रेडर के माध्यम से आउटपुट को प्रोसेस करना।
`run prompt` फ़ंक्शन का मुख्य उद्देश्य क्या है?	टेस्ट केस को टास्क के साथ मर्ज करना, परिणाम को Claude में फीड करना, और आउटपुट को वापस करना।
`run prompt` फ़ंक्शन के अंदर टेस्ट केस और टास्क को कैसे मर्ज किया जाता है?	एक F-string का उपयोग करके टेस्ट केस टास्क के साथ मर्ज किया जाता है।
`run test case` फ़ंक्शन का उद्देश्य क्या है?	एक व्यक्तिगत टेस्ट केस लेना, `run prompt` फ़ंक्शन को कॉल करना, परिणाम को ग्रेड करना, और एक सारांश डिक्शनरी लौटाना।
`run test case` फ़ंक्शन किस प्रकार की जानकारी लौटाता है?	आउटपुट (Claude से), टेस्ट केस, और स्कोर (जो वर्तमान में हार्डकोडेड है)।
`run eval` फ़ंक्शन की मुख्य भूमिका क्या है?	पूरे डेटा सेट को लोड करना, प्रत्येक टेस्ट केस के लिए `run test case` को कॉल करना, और सभी परिणामों को एक साथ असेंबल करना।
वर्तमान में, इस पूरे मूल्यांकन (eval) पाइपलाइन में कौन सा प्रमुख घटक अनुपस्थित है?	ग्रेडिंग (Grading) का कार्यान्वयन।
इस संदर्भ में "टेस्ट केस" (Test Case) क्या है?	डेटा सेट में मौजूद प्रत्येक व्यक्तिगत रिकॉर्ड।
