पाठ 13 / 29
Agent सीमाएँ, लागत और Stop Conditions
चरण, tokens, समय और पैसा सीमित करें।
हर loop को बजट चाहिए
Agent कई मॉडल calls करता है, हर एक बढ़ता message इतिहास दोबारा पढ़ती है, इसलिए लागत और latency चरणों की संख्या के साथ रेखीय से तेज़ बढ़ती है। कई सीमाएँ रखें: recursion limit, state में tool calls की अधिकतम संख्या, token बजट (इतिहास लंबा हो तो रुकें या सार करें), दीवार-घड़ी timeout, और प्रति run लागत सीमा। रुकने का व्यवहार पहले से तय करें: सर्वश्रेष्ठ आंशिक उत्तर लौटाएँ, user से पूछें, या मनुष्य को सौंपें। अपने traces में प्रति run tokens और लागत ट्रैक करें, और सबसे लंबे runs की नियमित समीक्षा करें: वे prompt समस्याएँ और छूटे tools उजागर करते हैं।
त्वरित जाँच: Agent की लागत चरणों की संख्या से तेज़ क्यों बढ़ती है?
- Tokens समय के साथ सस्ते होते हैं
- हर चरण लंबा होता message इतिहास दोबारा पढ़ता है
- Tools मुफ़्त हैं
- Graphs caching मना करते हैं
Answer
हर चरण लंबा होता message इतिहास दोबारा पढ़ता है — बढ़ता context बाद की calls को पहले की calls से महँगा बनाता है।