मान लीजिए आपका Claude Code बिल एक हफ्ते में $312 पहुँच जाता है। सब-एजेंट्स के इस्तेमाल का तरीका बदलिए और अगला हफ्ता ज़्यादा काम के बावजूद लगभग $124 में निकल सकता है — वही प्रोजेक्ट, करीब 60% कम खर्च। ये संख्याएँ काम करने के तरीके को समझाने का एक उदाहरण हैं, कोई मापा हुआ नतीजा नहीं — लेकिन जिस हल की ओर ये इशारा करती हैं वह असली है, और वह "सस्ता मॉडल इस्तेमाल करो" नहीं है।
ज़रूरी शब्द है Claude Code सब-एजेंट्स, और इनके बारे में जो भी लिखा गया है वह इन्हें समानांतर काम करने के खिलौने की तरह पेश करता है। असल में ये एक लागत नियंत्रण उपकरण हैं। यह बात किसी ने मुझे नहीं बताई थी।
एक लंबा थ्रेड पैसे क्यों बर्बाद करता है
वह बात जो आखिरकार मेरी समझ में आई, वह यह है। जब आप एक विशाल Claude Code सेशन में काम करते हैं, तो हर मैसेज पूरी बातचीत का इतिहास अपने साथ खींचता है। तीन घंटे बाद आपकी कॉन्टेक्स्ट विंडो पुराने फाइल डंप, असफल कोशिशों और आपके "नहीं, दूसरी फाइल" कहने के लॉग से भरी होती है। इन सबका भुगतान आप हर बार करते हैं।
सब-एजेंट को एक ताज़ा, सीमित कॉन्टेक्स्ट मिलता है। वह एक काम करता है, एक छोटा सा सारांश लौटाता है, और उसका फूला हुआ कार्यशील कॉन्टेक्स्ट गायब हो जाता है। मेन थ्रेड को कभी नहीं पता चलता कि सब-एजेंट ने 8,000 टोकन की फाइल सामग्री पढ़ी — उसे बस तीन पंक्तियों का जवाब मिलता है।
यही पूरी तरकीब है। सब-एजेंट्स कॉन्टेक्स्ट आइसोलेशन हैं। कॉन्टेक्स्ट आइसोलेशन लागत नियंत्रण है।
मैं वास्तव में काम कैसे बाँटती हूँ
मैं अब किसी फीचर को लगभग चार चरणों में बनाती हूँ और हर चरण के लिए सही काम करने वाले को चुनती हूँ।
मेन एजेंट हमेशा ऑर्केस्ट्रेटर रहता है। वह योजना रखता है और लगभग कुछ नहीं करता। फिर मैं सौंपती हूँ:
- एक रिसर्च सब-एजेंट कोडबेस पढ़कर बताता है: "यहाँ वे 4 फाइलें हैं जो auth को छूती हैं और वे क्या करती हैं।" वह 20 फाइलें पढ़ता है। मुझे एक पैराग्राफ मिलता है।
- एक बिल्डर सब-एजेंट उस पैराग्राफ के आधार पर असली बदलाव लिखता है।
- एक रिव्यूअर सब-एजेंट बिना किसी पूर्व जानकारी के डिफ पढ़ता है — यह उसे बेवकूफी की गलतियाँ पकड़ने में अजीब तरह से माहिर बनाता है।
रिव्यूअर का "भूलना" एक विशेषता है। एक नया एजेंट उस कोड के लिए तर्क नहीं गढ़ता जो उसने अभी लिखा है।
आप इन्हें .claude/agents/ में markdown फाइलों के रूप में परिभाषित करते हैं। एक सादा उदाहरण:
---
name: codebase-researcher
description: Finds and summarizes relevant files. Use before any change.
tools: Read, Grep, Glob
---
You locate the files relevant to the task and return a tight summary:
paths, what each does, and the 1-2 functions that matter. No code dumps.
tools लाइन पर ध्यान दें। मैंने रिसर्चर को केवल पढ़ने के उपकरण दिए। वह फाइल संपादित या कमांड नहीं चला सकता। इससे महँगी भटकन की एक पूरी श्रेणी रुक जाती है — जहाँ एजेंट आपकी टेस्ट सूट ग्यारह बार चलाकर "जाँच" करता है।
वह गलती जो सबसे ज़्यादा महँगी पड़ी
अस्पष्ट सौंपना। शुरुआत में मैं "लॉगिन बग ठीक करो" जैसे निर्देश के साथ सब-एजेंट चालू करती थी। वह पूरे कोडबेस को शुरू से पढ़ता क्योंकि उसे पता ही नहीं था कहाँ देखना है — और बिल्कुल वही टोकन जला देता था जो मैं बचाने की कोशिश कर रही थी। सब-एजेंट शून्य से शुरू करता था।
अब ऑर्केस्ट्रेटर पहले सस्ती टोह लेता है, फिर सब-एजेंट को एक विशिष्ट लक्ष्य देता है: "auth/session.ts में, रिफ्रेश टोकन रोटेट नहीं हो रहा। सिर्फ वह फंक्शन ठीक करो।" सीमित इनपुट, सीमित कॉन्टेक्स्ट, छोटा बिल।
अगर आपके सब-एजेंट प्रॉम्प्ट में फाइलों के नाम नहीं हैं, तो आप उसे भटकाने के लिए पैसे दे रहे हैं।
सब-एजेंट कब न इस्तेमाल करें
यह मुझे हैरान कर गया। सब-एजेंट्स मुफ्त नहीं हैं। हैंडऑफ में ओवरहेड होता है, और काम छोटा हो तो एक सब-एजेंट चालू करने की लागत सीधे काम करने से ज़्यादा होती है। एक वैरिएबल का नाम बदलना है? मेन थ्रेड में करो। दो लाइन के बदलाव के लिए कमेटी की ज़रूरत नहीं।
मैं गंध परीक्षण इस्तेमाल करती हूँ: अगर काम को ठीक से करने के लिए कुछ से ज़्यादा फाइलें पढ़नी हों, तो इसे सब-एजेंट में अलग करो। नहीं तो मत करो। समानांतर काम सिर्फ अपने लिए एक महँगा और धीमा तरीका है।
ठोस संख्याएँ
ऐसा $312 वाला हफ्ता आखिर जाता कहाँ है? बड़ा हिस्सा उन्हीं चार बड़ी फाइलों को लगभग हर बार दोबारा पढ़ने में जाता है क्योंकि वे सेशन कॉन्टेक्स्ट में पिन होती हैं। हज़ार बार पढ़कर मौत।
पुनर्गठित हफ्ते में, रिसर्च सब-एजेंट उन फाइलों को एक बार पढ़ता है, उनका सारांश बनाता है, और मेन थ्रेड उस सारांश पर चलता है। वे फाइलें तीस बार नहीं, बल्कि ठीक एक बार कॉन्टेक्स्ट में आती हैं। यह एकल बदलाव अधिकांश बचत का कारण है।
इसके ऊपर कुछ छोटी जीतें जुड़ीं। मैंने असंबंधित कामों के बीच कॉन्टेक्स्ट साफ करना शुरू किया। मैंने मेन थ्रेड में विशाल लॉग पेस्ट करना बंद किया और एक सब-एजेंट को उन्हें छाँटने दिया। और मैंने साधारण रिसर्च के लिए सस्ते मॉडल लगाए, जबकि असली बिल्डिंग और रिव्यू के लिए सबसे ताकतवर मॉडल रखा — होशियार को सोचने दो, तेज़ को ढूँढने दो।
अभी मेरी असली सेटअप
तीन एजेंट फाइलें: रिसर्चर, बिल्डर, रिव्यूअर। रिसर्चर और एक लॉग-ट्राइएज एजेंट सस्ते, तेज़ मॉडल पर चलते हैं। बिल्डर और रिव्यूअर मेरे पास के सबसे ताकतवर मॉडल पर — क्योंकि वहाँ गलतियाँ अलग तरह से महँगी होती हैं — खराब कोड टोकन से ज़्यादा महँगा पड़ता है।
ऑर्केस्ट्रेटर का काम हल्का रहना है। जैसे ही मेन थ्रेड फाइल सामग्री रखने लगे, मुझे पता चल जाता है कि मैंने गलती की है और मैं वह काम सब-एजेंट में डाल देती हूँ।
अकेले शिप करने का मतलब है आपका कंप्यूट बिल आपकी तनख्वाह का रूममेट है। हर टोकन जो आप बर्बाद नहीं करते, वह मार्जिन है। सब-एजेंट्स जल्दी जाने के लिए नहीं हैं — हालाँकि आप जल्दी जाते हैं। वे इसलिए हैं ताकि मेरी तरह एक ही फाइल को तीस बार पढ़ने के लिए पैसे न चुकाने पड़ें।
इस हफ्ते अपना उपयोग विवरण देखें। मुझे यकीन है वह भी पुनर्पाठ होगा।
