पाठ 17 / 26

असली Transcripts से सुधार

Runs देखें, पता करें Claude कहाँ अटका, और skill ठीक करें।

देखें, ठीक करें, दोबारा परखें

सबसे अच्छे सुधार असली उपयोग देखने से आते हैं। किसी run का transcript पढ़ें: क्या Claude को skill मिली? उसने कौन-सा निर्देश छोड़ा या ग़लत पढ़ा? क्या उसने उस चीज़ की खोज में चरण बर्बाद किए जो skill बता सकती थी? क्या उसने ऐसी files खोलीं जो ज़रूरी नहीं थीं, या ज़रूरी वाली चूक गया? क्या आउटपुट ग़लत रूप में बना? कारण ठीक करें: ग़ायब चरण जोड़ें, अस्पष्ट निर्देश तीखा करें, नियम ऊपर ले जाएँ या ठोस बनाएँ, दोहराई ग़लती के लिए बारीकी जोड़ें, description कसें, या नाज़ुक निर्देश को script बनाएँ। एक बार में एक चीज़ बदलें, अपनी trigger सूची और कुछ असली कार्य दोबारा चलाएँ, और नोट रखें क्या और क्यों बदला। यह भी पूछें कि skill अब भी चाहिए या नहीं: मॉडल सुधरते हैं, और जो निर्देश कभी मदद करते थे वे अनावश्यक overhead बन सकते हैं।

Skill सुधार log

छोटी प्रविष्टियाँ हर बदलाव को प्रमाण से जोड़ती हैं। तिथियाँ, संख्याएँ और skill स्वयं गढ़ा उदाहरण हैं।

date        observation (from a transcript)                      change                                   re-test
2026-03-02  skill not chosen for "what shipped this week?"         add "what shipped" to trigger phrases     trigger list 6/6
2026-03-09  model invented PR numbers                             gotcha + script prints PRs as JSON       3 tasks OK
2026-03-16  read 900-line reference every run                     "read ONLY if a request fails"           context -40%
2026-04-01  fires on code-review questions                        narrow description; add "not for review" false alarms 0/3

एक बार में एक चीज़ बदलें

वरना आप नहीं जान सकते कि किस संपादन ने व्यवहार ठीक या ख़राब किया।

त्वरित जाँच: Skill सुधारने के विचारों का सबसे अच्छा स्रोत क्या है?

  • हर जगह और पाठ जोड़ना
  • अनुमान
  • असली transcripts जो दिखाएँ Claude ने कहाँ ग़लत पढ़ा, छोड़ा या चरण बर्बाद किए
  • Description हटाना
Answer

असली transcripts जो दिखाएँ Claude ने कहाँ ग़लत पढ़ा, छोड़ा या चरण बर्बाद किए — निर्देश tune करते समय प्रमाण अंतर्ज्ञान से बेहतर है।