पाठ 17 / 26
असली Transcripts से सुधार
Runs देखें, पता करें Claude कहाँ अटका, और skill ठीक करें।
देखें, ठीक करें, दोबारा परखें
सबसे अच्छे सुधार असली उपयोग देखने से आते हैं। किसी run का transcript पढ़ें: क्या Claude को skill मिली? उसने कौन-सा निर्देश छोड़ा या ग़लत पढ़ा? क्या उसने उस चीज़ की खोज में चरण बर्बाद किए जो skill बता सकती थी? क्या उसने ऐसी files खोलीं जो ज़रूरी नहीं थीं, या ज़रूरी वाली चूक गया? क्या आउटपुट ग़लत रूप में बना? कारण ठीक करें: ग़ायब चरण जोड़ें, अस्पष्ट निर्देश तीखा करें, नियम ऊपर ले जाएँ या ठोस बनाएँ, दोहराई ग़लती के लिए बारीकी जोड़ें, description कसें, या नाज़ुक निर्देश को script बनाएँ। एक बार में एक चीज़ बदलें, अपनी trigger सूची और कुछ असली कार्य दोबारा चलाएँ, और नोट रखें क्या और क्यों बदला। यह भी पूछें कि skill अब भी चाहिए या नहीं: मॉडल सुधरते हैं, और जो निर्देश कभी मदद करते थे वे अनावश्यक overhead बन सकते हैं।
Skill सुधार log
छोटी प्रविष्टियाँ हर बदलाव को प्रमाण से जोड़ती हैं। तिथियाँ, संख्याएँ और skill स्वयं गढ़ा उदाहरण हैं।
date observation (from a transcript) change re-test
2026-03-02 skill not chosen for "what shipped this week?" add "what shipped" to trigger phrases trigger list 6/6
2026-03-09 model invented PR numbers gotcha + script prints PRs as JSON 3 tasks OK
2026-03-16 read 900-line reference every run "read ONLY if a request fails" context -40%
2026-04-01 fires on code-review questions narrow description; add "not for review" false alarms 0/3एक बार में एक चीज़ बदलें
वरना आप नहीं जान सकते कि किस संपादन ने व्यवहार ठीक या ख़राब किया।
त्वरित जाँच: Skill सुधारने के विचारों का सबसे अच्छा स्रोत क्या है?
- हर जगह और पाठ जोड़ना
- अनुमान
- असली transcripts जो दिखाएँ Claude ने कहाँ ग़लत पढ़ा, छोड़ा या चरण बर्बाद किए
- Description हटाना
Answer
असली transcripts जो दिखाएँ Claude ने कहाँ ग़लत पढ़ा, छोड़ा या चरण बर्बाद किए — निर्देश tune करते समय प्रमाण अंतर्ज्ञान से बेहतर है।