पाठ 13 / 29

Agent सीमाएँ, लागत और Stop Conditions

चरण, tokens, समय और पैसा सीमित करें।

हर loop को बजट चाहिए

Agent कई मॉडल calls करता है, हर एक बढ़ता message इतिहास दोबारा पढ़ती है, इसलिए लागत और latency चरणों की संख्या के साथ रेखीय से तेज़ बढ़ती है। कई सीमाएँ रखें: recursion limit, state में tool calls की अधिकतम संख्या, token बजट (इतिहास लंबा हो तो रुकें या सार करें), दीवार-घड़ी timeout, और प्रति run लागत सीमा। रुकने का व्यवहार पहले से तय करें: सर्वश्रेष्ठ आंशिक उत्तर लौटाएँ, user से पूछें, या मनुष्य को सौंपें। अपने traces में प्रति run tokens और लागत ट्रैक करें, और सबसे लंबे runs की नियमित समीक्षा करें: वे prompt समस्याएँ और छूटे tools उजागर करते हैं।

त्वरित जाँच: Agent की लागत चरणों की संख्या से तेज़ क्यों बढ़ती है?

  • Tokens समय के साथ सस्ते होते हैं
  • हर चरण लंबा होता message इतिहास दोबारा पढ़ता है
  • Tools मुफ़्त हैं
  • Graphs caching मना करते हैं
Answer

हर चरण लंबा होता message इतिहास दोबारा पढ़ता है — बढ़ता context बाद की calls को पहले की calls से महँगा बनाता है।