RAG पाइपलाइन का मूल प्रवाह क्या है?	स्रोत दस्तावेज़ को चंक्स में तोड़ना, प्रासंगिक टेक्स्ट खोजना, और उसे प्रॉम्प्ट में डालना।
दस्तावेज़ को चंक्स (chunks) में तोड़ना क्यों महत्वपूर्ण है?	यह RAG पाइपलाइन की गुणवत्ता पर बहुत बड़ा प्रभाव डालता है।
चंकिंग की तीन मुख्य रणनीतियाँ कौन सी हैं?	साइज़-आधारित (Size-based), संरचना-आधारित (Structure-based), और सिमेंटिक-आधारित (Semantic-based)।
साइज़-आधारित चंकिंग कैसे काम करती है?	बड़े दस्तावेज़ को समान लंबाई की स्ट्रिंग्स में विभाजित करना।
डिफ़ॉल्ट सेटिंग्स में चंक की लंबाई (chunk length) और ओवरलैप (overlap) क्या है?	चंक की लंबाई 150 और ओवरलैप 20 है।
चंक की सेटिंग्स को बदलने का मुख्य कारण क्या हो सकता है?	बेहतर और अधिक अर्थपूर्ण जानकारी वाले चंक प्राप्त करना।
चंकिंग में ओवरलैप का क्या उद्देश्य है?	यह सुनिश्चित करना कि जटिल वाक्यांश या जानकारी एक चंक से दूसरे चंक में न खो जाए।
'चंक बाय सेंटेंस' (Chunk by Sentence) रणनीति में डिफ़ॉल्ट रूप से कितने वाक्य प्रति चंक होते हैं?	डिफ़ॉल्ट रूप से प्रत्येक चंक में पाँच वाक्य होते हैं, जिसमें एक वाक्य का ओवरलैप होता है।
'चंक बाय सेक्शन' (Chunk by Section) रणनीति कब सबसे अच्छी होती है?	जब दस्तावेज़ की संरचना (structure) स्पष्ट हो, जैसे कार्यकारी सारांश या विशिष्ट खंड।
'चंक बाय सेक्शन' रणनीति की मुख्य सीमा क्या है?	यह उन दस्तावेज़ों के लिए काम नहीं करती जिनमें कोई फ़ॉर्मेटिंग न हो (जैसे उपयोगकर्ता द्वारा प्रदान किया गया कच्चा टेक्स्ट)।
कोड को चंक करते समय 'चंक बाय सेंटेंस' क्यों समस्याग्रस्त हो सकता है?	कोड में पूर्ण विराम (periods) अप्रत्याशित स्थानों पर हो सकते हैं, जिससे वाक्य विभाजन गलत हो जाता है।
सबसे विश्वसनीय और अंतिम विकल्प (fallback strategy) कौन सी है?	'चंक बाय कैरेक्टर' (Chunk by Character)।
'चंक बाय कैरेक्टर' रणनीति की मुख्य विशेषता क्या है?	यह सर्वोत्तम परिणाम की गारंटी नहीं देती, लेकिन यह अधिकांश समय काम करती है और उचित परिणाम देती है।
