विस्तारित सोच और प्रयास
कठिन समस्याओं के लिए, Claude जवाब देने से पहले सोचने में अतिरिक्त गणना ख़र्च कर सकता है — बहु-चरणीय तर्क, पेचीदा कोड, और गणित पर सटीकता में सुधार करता है। आप मोटे तौर पर नियंत्रित करते हैं कि कितना प्रयास ख़र्च करना है। यह पाठ आपको सिखाता है कि गहराई को कार्य के अनुरूप कैसे मिलाएँ, API के ज़रिए सोच कैसे चालू करें, और बिना अधिक भुगतान किए इसका बजट कैसे बनाएँ।
- समझौते को समझाएँ: कम सोच तेज़ और सस्ती है, अधिक सोच कठिन समस्याओं पर बेहतर है
- किसी दिए गए वर्कलोड के लिए सही प्रयास टियर (कम / मध्यम / उच्च) चुनें
- Messages API पर विस्तारित सोच सक्षम करें और सोच तथा टेक्स्ट ब्लॉक्स को पढ़ें
- सोच के टोकन का सही बजट बनाएँ ताकि budget_tokens, max_tokens से कम रहे
- एजेंटों में और चेन-ऑफ़-थॉट प्रॉम्प्टिंग के साथ प्रयास को समझदारी से लागू करें
प्रयास के पीछे का एक विचार
सोच एक डायल है, स्विच नहीं। दोनों छोरों की कल्पना करें:
- कम सोच = तेज़, सस्ता — सरल, अच्छी तरह-निर्दिष्ट कार्यों के लिए ठीक।
- अधिक सोच = वास्तव में कठिन समस्याओं पर बेहतर, उच्च लेटेंसी/लागत पर।
यहाँ वह पेंच है जो लोगों को उलझाता है: ऐसे कार्य के लिए जो पहले से ही आसान था, अतिरिक्त सोच कुछ नहीं करती। आप केवल लेटेंसी और लागत चुकाते हैं। कौशल यह है कि गहराई को वहाँ ख़र्च किया जाए जहाँ वह जवाब बदलती है।
नए मॉडल इसे एक प्रयास नियंत्रण के रूप में उजागर करते हैं (और सोच की गहराई को स्वचालित रूप से अनुकूलित करते हैं); उन पर, आप एक कच्चे टोकन बजट के बजाय एक टियर चुनते हैं। टियर को कार्य के अनुरूप मिलाएँ।
चरण 1 — अपनी गहराई चुनें
किसी भी कोड को छूने से पहले, पूछें: यह कार्य वास्तव में कितना कठिन है? इसे एक टियर से मिलाएँ।
| कार्य | सुझाया गया प्रयास |
|---|---|
| फ़ॉर्मेटिंग, निष्कर्षण, सरल Q&A | कम |
| रोज़मर्रा की कोडिंग, ड्राफ़्टिंग, विश्लेषण | मध्यम |
| कठिन डीबगिंग, पेचीदा एल्गोरिदम, सावधान प्रमाण | उच्च |
- हर चीज़ को अधिकतम पर डिफ़ॉल्ट न करें — जिस सोच की कार्य को ज़रूरत नहीं उसके लिए आप लेटेंसी और लागत में भुगतान करते हैं।
- मध्यम से शुरू करें; केवल वहीं बढ़ाएँ जहाँ गुणवत्ता की माँग हो।
ख़ुद आज़माएँ: आगे पढ़ने से पहले, इन तीनों को वर्गीकृत करें — (a) "इस टेक्स्ट से ईमेल निकालें", (b) "इस फ़ंक्शन को रीफ़ैक्टर करें", (c) "इस असमानता को सिद्ध करें"। किसके लिए कौन-सा टियर उपयुक्त है? अपने उत्तरों को ऊपर दी गई तालिका से मिलाएँ।
चरण 2 — इसे चालू करें (API)
Messages API पर, एक thinking ब्लॉक और एक टोकन बजट के साथ सोच सक्षम करें। इन चरणों का पालन करें।
- विस्तारित तर्क सक्षम करने के लिए messages.create पर thinking={"type": "enabled", "budget_tokens": N} पास करें।
- बजट उसी आउटपुट पूल से लिया जाता है, इसलिए budget_tokens, max_tokens से कम होना चाहिए।
- जवाब एक thinking ब्लॉक के बाद उत्तर टेक्स्ट के रूप में आता है — message.content पर इटरेट करें और प्रत्येक block.type को संभालें।
अब इसे जोड़ें। इसे कॉपी करें, चलाएँ, और जवाब को दो ब्लॉक्स के रूप में आते देखें — पहले तर्क, फिर उत्तर।
विस्तारित सोच सक्षम करें (Python)
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "Prove that 2^n > n^2 for all n >= 5."}],
)
for block in message.content:
if block.type == "thinking":
print("REASONING:", block.thinking)
elif block.type == "text":
print("ANSWER:", block.text)बड़ा बजट तर्क करने के लिए अधिक जगह ख़रीदता है, इसकी गारंटी नहीं कि Claude इसका पूरा उपयोग करेगा — गहराई समस्या के अनुसार अनुकूलित होती है। बजट को एक छत की तरह सेट करें, फिर यदि लेटेंसी बढ़े तो इसे घटाएँ। मॉडल ID मॉडल तालिका से आते हैं; नए मॉडलों पर सटीक पैरामीटर आकार भिन्न हो सकता है, इसलिए ऊपर लिंक किए गए स्रोत के विरुद्ध पुष्टि करें।
चरण 3 — इसे व्यवहार में अच्छी तरह उपयोग करें
तीन आदतें उन लोगों को अलग करती हैं जो सोच को सक्षम करते हैं और जो इसमें महारत रखते हैं:
- विस्तारित सोच चेन-ऑफ़-थॉट प्रॉम्प्टिंग के साथ अच्छी तरह जुड़ती है — लेकिन तर्क मॉडलों पर आपको अक्सर चरण-दर-चरण माँगने की ज़रूरत नहीं होती; सोच आंतरिक रूप से होती है।
- सोच टोकन की खपत करती है, जो लागत को प्रभावित करती है — तदनुसार बजट बनाएँ।
- एजेंटों के लिए, योजना चरण पर अधिक प्रयास और नियमित टूल कॉल्स पर कम एक अच्छा बँटवारा है।
- प्रयास/सोच कठिन समस्याओं पर सटीकता के बदले लेटेंसी और लागत का व्यापार करती है — जो कार्य पहले से ही सरल हैं उनके लिए यह कुछ नहीं करती।
- टियर: फ़ॉर्मेटिंग/निष्कर्षण/सरल Q&A के लिए कम, रोज़मर्रा की कोडिंग/ड्राफ़्टिंग/विश्लेषण के लिए मध्यम, कठिन डीबगिंग/एल्गोरिदम/प्रमाण के लिए उच्च।
- Messages API पर, budget_tokens उसी आउटपुट पूल से आता है, इसलिए यह max_tokens से कम होना चाहिए; जवाब पहले एक thinking ब्लॉक फिर एक text ब्लॉक होता है।
- बजट को एक छत की तरह मानें, लक्ष्य की तरह नहीं — Claude केवल उतना ही उपयोग करता है जितना समस्या को चाहिए।
- एजेंटों में, योजना पर प्रयास ख़र्च करें और नियमित टूल कॉल्स पर इसे बचाएँ।
इसे पक्का करें
जाने से पहले एक त्वरित स्मरण — प्रत्येक कार्ड को पलटें और ज़ोर से उत्तर दें।