पाठ 2 / 29

Coding Agent की संरचना

हिस्सों के नाम बताएँ: मॉडल, harness, tools, context और permissions।

मॉडल सिर्फ़ एक हिस्सा है

Coding agent language model से अधिक है। मॉडल तय करता है आगे क्या करना है। Harness (उसके आसपास का प्रोग्राम) loop चलाता है: वह बातचीत और tool विवरण मॉडल को भेजता है, मॉडल द्वारा माँगी tool calls चलाता है, अवलोकन (file सामग्री, command आउटपुट, test परिणाम) जोड़ता है और मॉडल को फिर बुलाता है। Tools हाथ और आँखें देते हैं: files पढ़ना और खोजना, files संपादित करना, shell commands और tests चलाना, git उपयोग करना, दस्तावेज़ लाना, बाहरी सेवाएँ बुलाना (जैसे MCP से)। Context वह सब है जो मॉडल एक साथ देख सकता है (निर्देश, प्रासंगिक files, इतिहास); permissions तय करती हैं कि कौन-से tools बिना पूछे चल सकते हैं। एक agent को दूसरे से बेहतर बनाने वाली अधिकांश बात harness में है: वह context कितनी अच्छी तरह चुनता है, files कितने भरोसे से संपादित करता है, errors से कैसे उबरता है, और permissions कितनी सुरक्षित रूप से सँभालता है।

एक चित्र में हिस्से

ऊपर से नीचे पढ़ें: लक्ष्य अंदर, सत्यापित बदलाव बाहर।

goal ("fix failing test") + instructions file + repo map
        |
   [ harness / loop ] <-- tool descriptions, permissions, budgets, logs
        |   ^
        v   | observations (file text, command output, test results)
   [ model ]  --- picks next action ---> [ tools: read, search, edit, run tests, git, MCP ]
        |
   done?  -- yes --> diff + summary for a human to review
          -- no  --> next step (until the step/cost limit)

Run के logs पढ़ें

Tool calls का क्रम ठीक बताता है कि agent उत्तर तक कैसे पहुँचा। उसे पढ़ना सीखें।

त्वरित जाँच: Harness क्या करता है?

  • Loop चलाता है: मॉडल बुलाता है, उसके tool अनुरोध चलाता है, परिणाम वापस देता है
  • मॉडल प्रशिक्षित करता है
  • Tests की जगह लेता है
  • मॉडल weights रखता है
Answer

Loop चलाता है: मॉडल बुलाता है, उसके tool अनुरोध चलाता है, परिणाम वापस देता है — Harness वह प्रोग्राम है जो मॉडल को agent बनाता है।