पाठ 4 / 25
Reflection और Self-Checking
Agent से मानदंडों के आधार पर अपना काम जँचवाएँ, और कोड से चलने वाली जाँचों को प्राथमिकता दें।
उत्तर से पहले जाँचें
Reflection में एक step जुड़ता है जहाँ agent पूरा करने से पहले अपने draft या नतीजे की समीक्षा करता है: क्या उत्तर सवाल को संबोधित करता है, क्या अंक जुड़ते हैं, क्या tool सचमुच सफल हुआ? सबसे मज़बूत जाँचें चलने योग्य हैं (tests चलाना, JSON validate करना, record दोबारा query करना)। ख़ुद की आलोचना करता model शैली और पूर्णता में मदद करता है पर अपनी ग़लतियाँ दोहरा भी सकता है।
आलोचक को अलग जानकारी दें
जो समीक्षक लेखक जितना ही context देखता है वह उसकी अंधी जगहें साझा करता है। जाँच को कुछ नया दें: मूल आवश्यकताएँ, checklist या असली tool output।
त्वरित जाँच: कौन-सी self-check सबसे भरोसेमंद है?
- "क्या आप पक्के हैं?" पूछना
- Tests चलाकर नतीजा पढ़ना
- वही उत्तर दोबारा पढ़ना
- उत्तर लंबा करना
Answer
Tests चलाकर नतीजा पढ़ना — चलने योग्य जाँचें दूसरी राय की जगह वस्तुनिष्ठ प्रमाण देती हैं।