पाठ 24 / 29

उत्पादकता और गुणवत्ता ईमानदारी से मापना

कोड की पंक्तियों से आगे lead time, दोबारा काम और defects देखें।

तेज़ टाइपिंग तेज़ डिलीवरी नहीं

Agent के साथ तेज़ महसूस करना आसान है और साबित करना कठिन। कोड की पंक्तियाँ या PRs की संख्या मात्रा को पुरस्कृत करती हैं, मूल्य को नहीं, और अतिरिक्त समीक्षा, दोबारा काम और bugs छिपा सकती हैं। बेहतर माप: कार्य शुरू से merge हुए बदलाव तक lead time, समीक्षा समय और दौर, दोबारा काम (merge के बाद कितना दोबारा लिखा गया), defect और incident दरें, test coverage और CI स्थिरता, और developers द्वारा बताया संज्ञानात्मक बोझ व संतुष्टि। Baseline (अपनाने से पहले वैसे ही कार्य, या control समूह) से तुलना करें, और देखें किन कार्यों को लाभ होता है: boilerplate, tests, migrations और खोजबीन को अक्सर बहुत लाभ होता है, जबकि नए डिज़ाइन और सूक्ष्म debugging को नहीं। छिपी क़ीमतों पर नज़र रखें: बड़े diffs से समीक्षकों पर बोझ, juniors में कौशल क्षय, और ऐसे कोड की वृद्धि जिसे कोई पूरी तरह नहीं समझता।

पहले और बाद मापें

Baseline के बिना आप नहीं जान सकते कि agent ने मदद की या बस तेज़ महसूस हुआ।

त्वरित जाँच: "लिखी कोड पंक्तियों" से बेहतर असली मूल्य कौन-सा माप दर्शाता है?

  • भेजे prompts की संख्या
  • टाइप किए अक्षरों की संख्या
  • Defect और दोबारा काम दरों के साथ merge हुए बदलाव तक lead time
  • Chat window में बिताया समय
Answer

Defect और दोबारा काम दरों के साथ merge हुए बदलाव तक lead time — मूल्य डिलीवरी की गति और गुणवत्ता में दिखता है, आउटपुट की मात्रा में नहीं।