# Updates, Deletes और ताज़गी — Embeddings और Vector Search

Source: https://www.geekswithgeeks.com/hi/embeddings/p-fresh

> Index को बदलते दस्तावेज़ों के साथ तालमेल में रखें।

## पुराने vectors पुराने उत्तर देते हैं

दस्तावेज़ बदलते हैं, इसलिए index को भी बदलना चाहिए। हर chunk को स्थिर **ID**, **स्रोत दस्तावेज़ ID** और **content hash** दें; बदलाव पर सिर्फ़ बदले दस्तावेज़ दोबारा chunk और embed करें और उनके पुराने chunks **बदलें** (स्रोत ID से delete, फिर insert)। **हटाए जाने** और **अनुमति बदलावों** को तुरंत सँभालें, क्योंकि हटाया या प्रतिबंधित दस्तावेज़ retrieve होना बंद होना चाहिए। कुछ ANN संरचनाएँ deletes को आलसी ढंग से सँभालती हैं (प्रविष्टियाँ deleted चिह्नित करके रखरखाव में साफ़ करना), और भारी उथल-पुथल में आवधिक **rebuilds** या **compaction** चाहिए हो सकते हैं। वर्तमान सामग्री को प्राथमिकता देने के लिए **संस्करण और प्रभावी-तिथि metadata** रखें, और **index lag** मॉनिटर करें (बदलाव खोज योग्य होने में कितना समय लगता है)। बड़े batch अद्यतनों के लिए नया index बनाएँ और atomic रूप से बदलें।

## Index lag मॉनिटर करें

मापें कि नया या हटाया दस्तावेज़ परिणामों में दिखने या ग़ायब होने में कितना समय लेता है, और बढ़ने पर alert दें।

**Quiz:** बदले दस्तावेज़ को index में कैसे अद्यतन करें?

- [ ] नए chunks जोड़ें और पुराने रखें
- [x] उसे दोबारा embed करें और स्रोत दस्तावेज़ ID से उसके पुराने chunks बदलें
- [ ] कुछ rebuild न करें और आशा रखें
- [ ] Vector संख्याएँ हाथ से बदलें

*Answer:* उसे दोबारा embed करें और स्रोत दस्तावेज़ ID से उसके पुराने chunks बदलें. पुराने chunks छोड़ने से पुराने, विरोधाभासी परिणाम मिलते हैं।
