Claude On Google Cloud
← सभी पाठ
पाठ 03Claude On Google Cloud

Accessing the API

सारांश ऑडियो

इस पाठ के लिए कोई ऑडियो सारांश नहीं है।

अध्ययन नोट्स

Claude API एक्सेस और टेक्स्ट जनरेशन के मुख्य नोट्स

**I. आर्किटेक्चर और सुरक्षा (Architecture and Security)**

  • सुरक्षित एक्सेस: क्लाइंट-साइड ऐप (वेब/मोबाइल) से सीधे Vertex को एक्सेस नहीं करना चाहिए।
  • आवश्यक प्रक्रिया: सभी अनुरोध (requests) एक मध्यस्थ सर्वर (Server) के माध्यम से किए जाने चाहिए जिसे डेवलपर नियंत्रित करता है।
  • कारण: गुप्त क्रेडेंशियल्स (Secret Credentials) को क्लाइंट-साइड से छिपाए रखने के लिए।
  • SDK का उपयोग: सर्वर से Vertex को अनुरोध भेजने के लिए Anthropic या Google के आधिकारिक SDK (जैसे Python, TypeScript) का उपयोग किया जाता है।

**II. अनुरोध में आवश्यक डेटा (Required Request Data)**

  • मॉडल का नाम (Model Name): वह विशिष्ट मॉडल जिसे चलाना है।
  • संदेशों की सूची (List of Messages): उपयोगकर्ता द्वारा सबमिट किया गया टेक्स्ट।
  • अधिकतम टोकन (Max Tokens): जनरेट किए जाने वाले टेक्स्ट की अधिकतम लंबाई को सीमित करने वाला मान।

**III. टेक्स्ट जनरेशन प्रक्रिया (Text Generation Process)**

टेक्स्ट जनरेशन को चार मुख्य चरणों में विभाजित किया गया है:

  • टोकनाइजेशन (Tokenization):
  • इनपुट टेक्स्ट को छोटे टुकड़ों में तोड़ा जाता है, जिन्हें 'टोकन' कहा जाता है (ये पूरे शब्द, शब्द के हिस्से, या प्रतीक हो सकते हैं)।
  • एम्बेडिंग (Embedding):
  • प्रत्येक टोकन को एक एम्बेडिंग में बदला जाता है, जो एक लंबी संख्या सूची (number-based definition) होती है।
  • संदर्भित करना (Contextualization):
  • यह प्रक्रिया प्रत्येक एम्बेडिंग को उसके आस-पास के अन्य एम्बेडिंग के आधार पर समायोजित करती है।
  • उद्देश्य: शब्द के संदर्भ के अनुसार उसके सटीक अर्थ को निर्धारित करना।
  • जनरेशन (Generation):
  • प्रोसेस्ड एम्बेडिंग आउटपुट लेयर को पास की जाती हैं, जो अगले संभावित शब्द के लिए संभावनाएँ (probabilities) उत्पन्न करती हैं।
  • चयन: मॉडल उच्चतम संभावना वाले शब्द को स्वचालित रूप से नहीं चुनता; यह प्राकृतिक और विविध प्रतिक्रियाएँ बनाने के लिए संभावना और यादृच्छिकता (randomness) का मिश्रण उपयोग करता है।
  • पुनरावृत्ति: चयनित शब्द को एम्बेडिंग सूची में जोड़ा जाता है, और पूरी प्रक्रिया दोहराई जाती है।

**IV. जनरेशन की समाप्ति (Stopping Criteria)**

मॉडल टेक्स्ट जनरेट करना कब बंद करता है, इसके लिए दो मुख्य जाँचें होती हैं:

  • अधिकतम टोकन सीमा: यदि जनरेट किए गए टोकन की संख्या, अनुरोध में दिए गए 'Max Tokens' पैरामीटर से अधिक हो जाती है।
  • एंड ऑफ सीक्वेंस टोकन (End of Sequence Token): एक विशेष संकेत जो मॉडल द्वारा प्राकृतिक समाप्ति को दर्शाने के लिए उत्पन्न किया जाता है।

**V. प्रतिक्रिया (Response)**

  • जब जनरेटर पूरा हो जाता है, तो API सर्वर को एक प्रतिक्रिया भेजता है।
  • प्रतिक्रिया में शामिल हैं:
  • जनरेट किया गया टेक्स्ट।
  • उपयोग (Usage): इनपुट और आउटपुट टोकन की संख्या।
  • स्टॉप कारण (Stop Reason): यह बताता है कि मॉडल क्यों रुका (जैसे, प्राकृतिक अंत या टोकन सीमा पार)।
  • सर्वर इस प्रतिक्रिया को क्लाइंट/मोबाइल ऐप को भेजता है, जहाँ टेक्स्ट प्रदर्शित होता है।

Takeaways

  • API एक्सेस के लिए क्लाइंट से सीधे Vertex को एक्सेस नहीं किया जाना चाहिए; सभी अनुरोध एक मध्यस्थ सर्वर के माध्यम से किए जाने चाहिए।
  • टेक्स्ट जनरेशन की प्रक्रिया टोकनाइजेशन → एम्बेडिंग → संदर्भित करना → जनरेशन के चरणों से गुजरती है।
  • आउटपुट की लंबाई 'Max Tokens' पैरामीटर और 'End of Sequence Token' द्वारा नियंत्रित होती है।
  • API प्रतिक्रिया में जनरेट किया गया टेक्स्ट, उपयोग (टोकन संख्या), और मॉडल के रुकने का कारण (Stop Reason) शामिल होता है।
फ्लैशकार्ड 10 कार्ड
प्रश्न
प्रकट करने के लिए क्लिक करें · ←/→
उत्तर
वापस पलटने के लिए क्लिक करें
ज्ञान जाँच 0 प्रश्न

No quiz for this lesson yet.