मुख्य कंटेंट तक स्किप करें

विस्तारित सोच और प्रयास

मध्यम

कठिन समस्याओं के लिए, Claude जवाब देने से पहले सोचने में अतिरिक्त गणना ख़र्च कर सकता है — बहु-चरणीय तर्क, पेचीदा कोड, और गणित पर सटीकता में सुधार करता है। आप मोटे तौर पर नियंत्रित करते हैं कि कितना प्रयास ख़र्च करना है। यह पाठ आपको सिखाता है कि गहराई को कार्य के अनुरूप कैसे मिलाएँ, API के ज़रिए सोच कैसे चालू करें, और बिना अधिक भुगतान किए इसका बजट कैसे बनाएँ।

What you'll learn
  • समझौते को समझाएँ: कम सोच तेज़ और सस्ती है, अधिक सोच कठिन समस्याओं पर बेहतर है
  • किसी दिए गए वर्कलोड के लिए सही प्रयास टियर (कम / मध्यम / उच्च) चुनें
  • Messages API पर विस्तारित सोच सक्षम करें और सोच तथा टेक्स्ट ब्लॉक्स को पढ़ें
  • सोच के टोकन का सही बजट बनाएँ ताकि budget_tokens, max_tokens से कम रहे
  • एजेंटों में और चेन-ऑफ़-थॉट प्रॉम्प्टिंग के साथ प्रयास को समझदारी से लागू करें

प्रयास के पीछे का एक विचार

सोच एक डायल है, स्विच नहीं। दोनों छोरों की कल्पना करें:

  • कम सोच = तेज़, सस्ता — सरल, अच्छी तरह-निर्दिष्ट कार्यों के लिए ठीक।
  • अधिक सोच = वास्तव में कठिन समस्याओं पर बेहतर, उच्च लेटेंसी/लागत पर।

यहाँ वह पेंच है जो लोगों को उलझाता है: ऐसे कार्य के लिए जो पहले से ही आसान था, अतिरिक्त सोच कुछ नहीं करती। आप केवल लेटेंसी और लागत चुकाते हैं। कौशल यह है कि गहराई को वहाँ ख़र्च किया जाए जहाँ वह जवाब बदलती है

नए मॉडल इसे एक प्रयास नियंत्रण के रूप में उजागर करते हैं (और सोच की गहराई को स्वचालित रूप से अनुकूलित करते हैं); उन पर, आप एक कच्चे टोकन बजट के बजाय एक टियर चुनते हैं। टियर को कार्य के अनुरूप मिलाएँ।

चरण 1 — अपनी गहराई चुनें

किसी भी कोड को छूने से पहले, पूछें: यह कार्य वास्तव में कितना कठिन है? इसे एक टियर से मिलाएँ।

कार्यसुझाया गया प्रयास
फ़ॉर्मेटिंग, निष्कर्षण, सरल Q&Aकम
रोज़मर्रा की कोडिंग, ड्राफ़्टिंग, विश्लेषणमध्यम
कठिन डीबगिंग, पेचीदा एल्गोरिदम, सावधान प्रमाणउच्च
Pro tip
  • हर चीज़ को अधिकतम पर डिफ़ॉल्ट न करें — जिस सोच की कार्य को ज़रूरत नहीं उसके लिए आप लेटेंसी और लागत में भुगतान करते हैं।
  • मध्यम से शुरू करें; केवल वहीं बढ़ाएँ जहाँ गुणवत्ता की माँग हो।

ख़ुद आज़माएँ: आगे पढ़ने से पहले, इन तीनों को वर्गीकृत करें — (a) "इस टेक्स्ट से ईमेल निकालें", (b) "इस फ़ंक्शन को रीफ़ैक्टर करें", (c) "इस असमानता को सिद्ध करें"। किसके लिए कौन-सा टियर उपयुक्त है? अपने उत्तरों को ऊपर दी गई तालिका से मिलाएँ।

चरण 2 — इसे चालू करें (API)

Messages API पर, एक thinking ब्लॉक और एक टोकन बजट के साथ सोच सक्षम करें। इन चरणों का पालन करें।

Guided walkthrough1 of 3
  1. विस्तारित तर्क सक्षम करने के लिए messages.create पर thinking={"type": "enabled", "budget_tokens": N} पास करें।

अब इसे जोड़ें। इसे कॉपी करें, चलाएँ, और जवाब को दो ब्लॉक्स के रूप में आते देखें — पहले तर्क, फिर उत्तर।

विस्तारित सोच सक्षम करें (Python)

import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
  model="claude-sonnet-5",
  max_tokens=16000,
  thinking={"type": "enabled", "budget_tokens": 10000},
  messages=[{"role": "user", "content": "Prove that 2^n > n^2 for all n >= 5."}],
)

for block in message.content:
  if block.type == "thinking":
      print("REASONING:", block.thinking)
  elif block.type == "text":
      print("ANSWER:", block.text)

बड़ा बजट तर्क करने के लिए अधिक जगह ख़रीदता है, इसकी गारंटी नहीं कि Claude इसका पूरा उपयोग करेगा — गहराई समस्या के अनुसार अनुकूलित होती है। बजट को एक छत की तरह सेट करें, फिर यदि लेटेंसी बढ़े तो इसे घटाएँ। मॉडल ID मॉडल तालिका से आते हैं; नए मॉडलों पर सटीक पैरामीटर आकार भिन्न हो सकता है, इसलिए ऊपर लिंक किए गए स्रोत के विरुद्ध पुष्टि करें।

चरण 3 — इसे व्यवहार में अच्छी तरह उपयोग करें

तीन आदतें उन लोगों को अलग करती हैं जो सोच को सक्षम करते हैं और जो इसमें महारत रखते हैं:

  • विस्तारित सोच चेन-ऑफ़-थॉट प्रॉम्प्टिंग के साथ अच्छी तरह जुड़ती है — लेकिन तर्क मॉडलों पर आपको अक्सर चरण-दर-चरण माँगने की ज़रूरत नहीं होती; सोच आंतरिक रूप से होती है।
  • सोच टोकन की खपत करती है, जो लागत को प्रभावित करती है — तदनुसार बजट बनाएँ।
  • एजेंटों के लिए, योजना चरण पर अधिक प्रयास और नियमित टूल कॉल्स पर कम एक अच्छा बँटवारा है।
Key takeaways
  • प्रयास/सोच कठिन समस्याओं पर सटीकता के बदले लेटेंसी और लागत का व्यापार करती है — जो कार्य पहले से ही सरल हैं उनके लिए यह कुछ नहीं करती।
  • टियर: फ़ॉर्मेटिंग/निष्कर्षण/सरल Q&A के लिए कम, रोज़मर्रा की कोडिंग/ड्राफ़्टिंग/विश्लेषण के लिए मध्यम, कठिन डीबगिंग/एल्गोरिदम/प्रमाण के लिए उच्च।
  • Messages API पर, budget_tokens उसी आउटपुट पूल से आता है, इसलिए यह max_tokens से कम होना चाहिए; जवाब पहले एक thinking ब्लॉक फिर एक text ब्लॉक होता है।
  • बजट को एक छत की तरह मानें, लक्ष्य की तरह नहीं — Claude केवल उतना ही उपयोग करता है जितना समस्या को चाहिए।
  • एजेंटों में, योजना पर प्रयास ख़र्च करें और नियमित टूल कॉल्स पर इसे बचाएँ।

इसे पक्का करें

जाने से पहले एक त्वरित स्मरण — प्रत्येक कार्ड को पलटें और ज़ोर से उत्तर दें।

कार्ड पलटने के लिए Enter या Space दबाएँ। कार्ड बदलने के लिए बाएँ और दाएँ तीर कुंजियों का उपयोग करें।शब्द दिखाया गया।
1 / 5

ख़ुद को परखें

0/5
  1. अधिक सोच का प्रयास ख़र्च करने का मूल समझौता क्या है?
  2. कौन-सा प्रयास टियर रोज़मर्रा की कोडिंग, ड्राफ़्टिंग, और विश्लेषण के लिए उपयुक्त है?
  3. Messages API पर, budget_tokens के बारे में क्या सत्य होना चाहिए?
  4. जब विस्तारित सोच सक्षम होती है तो जवाब कैसे आता है?
  5. एजेंटों के लिए, आपको प्रयास को कैसे बाँटना चाहिए?

आगे