पाठ 4 / 25

Reflection और Self-Checking

Agent से मानदंडों के आधार पर अपना काम जँचवाएँ, और कोड से चलने वाली जाँचों को प्राथमिकता दें।

उत्तर से पहले जाँचें

Reflection में एक step जुड़ता है जहाँ agent पूरा करने से पहले अपने draft या नतीजे की समीक्षा करता है: क्या उत्तर सवाल को संबोधित करता है, क्या अंक जुड़ते हैं, क्या tool सचमुच सफल हुआ? सबसे मज़बूत जाँचें चलने योग्य हैं (tests चलाना, JSON validate करना, record दोबारा query करना)। ख़ुद की आलोचना करता model शैली और पूर्णता में मदद करता है पर अपनी ग़लतियाँ दोहरा भी सकता है।

आलोचक को अलग जानकारी दें

जो समीक्षक लेखक जितना ही context देखता है वह उसकी अंधी जगहें साझा करता है। जाँच को कुछ नया दें: मूल आवश्यकताएँ, checklist या असली tool output।

त्वरित जाँच: कौन-सी self-check सबसे भरोसेमंद है?

  • "क्या आप पक्के हैं?" पूछना
  • Tests चलाकर नतीजा पढ़ना
  • वही उत्तर दोबारा पढ़ना
  • उत्तर लंबा करना
Answer

Tests चलाकर नतीजा पढ़ना — चलने योग्य जाँचें दूसरी राय की जगह वस्तुनिष्ठ प्रमाण देती हैं।